ML-инженер — обучение аудиоязыковых моделей@ Яндекс
О позиции
Наша команда обучает аудиоязыковые модели нового поколения. Мы хотим, чтобы одна модель могла понимать звучащий вокруг мир: речь, интонацию, настроение собеседника, фоновые события, музыку, шумы и другие сигналы. Мы ищем ML-инженера, который сможет влиять на архитектуру, обучение и качество моделей: от исследовательских гипотез до работающих пайплайнов. Ваша роль как ML-инженера будет заключаться в том, чтобы активно участвовать в обучении аудиоязыковых моделей и вносить свой вклад в развитие нашей команды.
Чем вы будете заниматься
- Обучение аудиоязыковых моделей: участвовать в полном цикле обучения моделей, включая претрейн, SFT и GRPO. Проектировать эксперименты, анализировать качество, находить слабые места моделей и улучшать их на сложных срезах данных.
- Исследование архитектур и рецептов обучения: разбираться в современных подходах к LLM, audio encoders, speech/audio understanding, multimodal alignment и обучению моделей по reward-сигналам.
- Работа с данными и метриками качества: участвовать в построении датасетов, формулировать задачи для обучения и оценки, выбирать метрики для разных сценариев.
- Развитие исследовательской и инженерной инфраструктуры: следить за качеством реализации, обеспечивая воспроизводимые эксперименты, эффективные пайплайны и стабильное обучение.
Требования
- Опыт обучения LLM или мультимодальных моделей.
- Понимание полного цикла ML-разработки.
- Способность разбираться в ML-статьях, формулировать на их основе гипотезы, проводить эксперименты и делать выводы.
- Готовность отвечать за направление, архитектурные решения или крупный исследовательский трек.
Будет плюсом, если вы:
- Работали с аудио, речевыми технологиями, ASR, TTS, speaker/audio understanding или audio representation learning.
- Обучали мультимодальные модели или применяли SFT, RLHF, DPO, GRPO и другие методы посттрейна.
Что мы предлагаем
- Мы заботимся о детях яндексоидов и устраиваем детские дни в офисе.
- Полный список бонусов доступен на нашем сайте.
- Гибкий график работы и возможность удалённой работы.
- Доступ к современным инструментам и технологиям для работы.
- Команда профессионалов, готовых делиться опытом и знаниями.
Вакансия предлагает интересные задачи в области аудиоязыковых моделей, но не указана конкретная зарплата. Команда профессионалов и гибкий график работы делают её привлекательной.
Формируем профиль успеха...
Анализируем требования вакансии и данные рынка
Обзор рынка
Навыки и требования
Тренды отрасли
Новости Audio Processing
Загружаем новости отрасли...
Ищем релевантные статьи за последние 6 месяцев