ML-разработчик в команду синтеза речи
Команда синтеза речи развивает TTS для озвучки видео и голосовых продуктов Яндекса; вы будете обучать и оптимизировать нейросетевые TTS-модели, работать с данными и ускорять инференс в продакшн-рантайме, чтобы улучшать качество озвучки для миллионов пользователей
ГрейдMiddle/Senior
Стек
PythonPyTorchC++CUDAcuDNNcuBLASTensorRTGPU
Задачи
- •Обучать SOTA TTS-модели для мультиязычного zero-shot синтеза и voice conversion
- •Перенос интонации и эмоций в моделях TTS
- •Собирать, фильтровать и готовить аудио/текстовые датасеты для претрейнов
- •Оптимизировать рантайм и инференс нейросетей для высоконагруженного продакшна
Обязательно
- •Понимание принципов машинного обучения
- •Опыт обучения нейросетевых моделей в индустрии или в исследованиях
- •Хорошее знание Python
- •Опыт работы с экспериментами на GPU
Будет плюсом
- •Опыт в голосовых технологиях: ASR, голосовая биометрия, TTS или voice conversion
- •Опыт с NLP или computer vision
- •Знание cuDNN, cuBLAS, CUDA, TensorRT