Tech Lead NLP Engineer — LLM Inference для AI-продукта

292K ₽–364K ₽/мес
оценка на руки
Опубликовано 02.10.2026

О позиции

Возглавьте техническое развитие NLP в AI-продукте, где большие языковые модели уже работают в production. Компания развивает платформу для персонализированного общения с AI-персонажами, дообучает open-source модели и работает с LLM до 1T параметров.

Чем вы будете заниматься

  • Около 70% времени - hands-on engineering, без Project/People Management
  • Оптимизация скорости, стоимости и стабильности inference больших LLM
  • Distributed inference на multi-GPU / multi-node инфраструктуре: 32×H200 + AWS
  • Training и post-training LLM, развитие agent architectures
  • Техническое лидерство NLP/CV-команды и перспектива роста до Head of ML
  • Сильная команда, высокое вознаграждение, удаленно

Требования

  • Есть production-опыт оптимизации LLM inference: SGLang / vLLM / TensorRT-LLM
  • Работали с distributed inference/training больших моделей: MoE, tensor/expert/pipeline parallelism, multi-node GPU
  • Сильны в KV cache, attention kernels, batching, quantization, GPU profiling
  • Есть опыт training/fine-tuning и post-training: RLHF, DPO или аналоги
  • Уверенно работаете с PyTorch / Transformers
  • English В2+
Обязательные
0/1
Желательные
0/1
Бонус
0/1
Почему эта вакансия
7.5
7.5 из 10
оценка совпадения

Вакансия предлагает интересные задачи в области NLP с возможностью профессионального роста. Условия работы конкурентоспособные, но зарплата не указана.

Требования к языку
АнглийскийB2
БазовыйСреднийПродвинутыйРодной

Формируем профиль успеха...

Анализируем требования вакансии и данные рынка

Загружаем обзор рынка...

Анализируем тренды рынка и спрос на навыки

Новости AI/Big Data

Загружаем новости отрасли...

Ищем релевантные статьи за последние 6 месяцев

Похожие вакансии