О позиции
Компания Acclaim (ранее Aiphoria) ищет DevOps/SRE Engineer для работы над платформой Voice AI. Это удалённая позиция, где вы будете заниматься развертыванием и масштабированием микросервисной платформы на Kubernetes в облаках AWS и GCP, а также на локальных серверах.
Чем вы будете заниматься
- Развёртывание, эксплуатация и масштабирование микросервисной платформы на Kubernetes.
- Работа с ML-сервисами на GPU (Triton, vLLM) на платформах RunPod, Scaleway и Nebius.
- Ведение расследований инцидентов, отладка развертываний и устранение проблем с производительностью.
- Создание и поддержка CI/CD пайплайнов (GitHub + GitLab) и инфраструктуры как кода (Terraform, Ansible).
- Разработка систем наблюдаемости (Grafana/Prometheus, ELK) и управление доступом и соблюдением норм (NetBird VPN, SOC 2).
Требования
- Минимум 5 лет опыта в роли DevOps или Site Reliability Engineering.
- Глубокие знания администрирования Linux.
- Опыт развертывания и масштабирования Kubernetes в облачных и локальных средах.
- Глубокая экспертиза в одном из крупных облачных провайдеров (предпочтительно Google Cloud Platform).
- Опыт внедрения практик SRE и построения систем наблюдаемости с использованием Grafana, Prometheus и Loki.
- Знания в области GitOps, Infrastructure as Code (IaC) и принципов CI/CD.
- Продвинутые навыки в Terraform, Ansible и Python.
Что мы предлагаем
- Работа в команде, которая создала награждённые AI-продукты для технологических компаний.
- Современный стек технологий: технологии речи, NLP, генеративный AI (LLMs, диффузионные модели).
- Высокие стандарты инженерии и реальная ответственность — команда заботится о том, что работает в производстве.
- Быстрый карьерный рост — команда с высоким уровнем квалификации и множество реальных задач.
- Полностью удалённая работа, 21 день отпуска + праздничные дни + 5 больничных дней.
- Частные уроки английского языка через Preply.
Вакансия предлагает интересные задачи и хороший уровень зарплаты. Однако, отсутствие конкретной информации о компании может вызывать вопросы.
Кто здесь добьётся успеха
Глубокое знание Linux и опыт работы с системами на базе Linux, включая оптимизацию производительности и безопасность серверов.
Опыт развертывания приложений в Kubernetes с использованием Helm и управления конфигурациями через Terraform и Ansible.
Способность к автоматизации процессов с использованием Python и интеграции мониторинга с Grafana и Prometheus для обеспечения надежности сервисов.
Ресурсы для обучения
Карьерный путь
Обзор рынка
Навыки и требования
Тренды отрасли
Новости AI/Voice Technologies
Загружаем новости отрасли...
Ищем релевантные статьи за последние 6 месяцев