Senior Deep Learning Engineer (Speech LLM)
офис, гибрид, Москва
Команда разрабатывает Next Gen ASR — инструктивную audio-native LLM-систему для расширенного распознавания речи с временными метками, диаризацией, тегированием звуков и keyword prompting; роль важна для автоматизации разметки и повышения качества ASR/TTS в продакшне
ГрейдSenior
Стек
PythonPyTorchDDPTensor ParallelismFSDPPre-trainingSFTDPOOnline RLDeepSeek3.2Qwen3.5GigaAMGigaChat Audio
Задачи
- •Обучение больших audio-conditioned LLM и развитие LLM-based ASR функций
- •Проведение масштабных ML-экспериментов с Supervised Fine-Tuning и Online Reinforcement Learning
- •Дистилляция моделей для создания быстрых production-версий
- •Автоматическая разметка данных и создание высококачественных датасетов
- •Анализ научных статей, быстрая проверка гипотез и доведение успешных прототипов до продакшена
Обязательно
- •Уверенное владение Python и PyTorch, модульный код, ООП, типизация и тесты
- •Практический опыт распределённого обучения больших моделей (DDP, FSDP, Tensor Parallelism)
- •Понимание пайплайнов обучения LLM: Pre-training, SFT, DPO, online RL
- •Умение читать научные статьи и быстро переносить исследования в код
- •Опыт Knowledge Distillation и оптимизации моделей для production
- •Знание архитектур современных LLM (например DeepSeek3.2, Qwen3.5)
Будет плюсом
- •Опыт работы с аудио и мультимодальными LLM
- •Опыт создания датасетов и разметки аудио для ML