Senior Deep Learning Engineer (Speech / Audio Foundation Models)
офис, гибрид, Москва
Команда развивает GigaAM — open‑source foundation‑модель для русской речи и общего аудио‑понимания. Вы будете масштабировать данные и модели, улучшать предобучение и переводить исследования в стабильные production‑решения, влияющие на несколько продуктов экосистемы
ГрейдSenior
Стек
PythonPyTorchDistributed Training (DDP/FSDP/ZeRO)Speech/Audio Self‑Supervised Learningмасштабирование моделей (scaling laws)профилирование и оптимизация DL‑пайплайнов
Задачи
- •масштабирование корпусов данных и построение пайплайнов фильтрации и подготовки
- •разработка и улучшение архитектур и методов предобучения моделей
- •масштабирование моделей по числу параметров (scaling laws)
- •проведение ML‑экспериментов, проверка гипотез и доведение результатов до продакшена и публикаций
- •стабилизация процессов предобучения и оптимизация производительности обучающих пайплайнов
Обязательно
- •уверенное владение Python
- •опыт работы с PyTorch
- •практический опыт распределённого обучения (DDP, FSDP, ZeRO)
- •опыт профилирования и оптимизации DL‑пайплайнов (I/O, память, GPU‑utilization)
- •экспертиза в Speech/Audio и self‑supervised подходах