Старший LLM-разработчик в Нейро
Команда развивает Align-модели для системы ответов Нейро: обучение SFT, исследование RL-методов и оптимизации моделей для многомиллионной нагрузки. Роль важна для повышения качества ответов в чатах и интеграции мультимодальных источников
ГрейдSenior
Опыт6+ лет
Стек
PythonSFTRLMoEквантованиедистилляцияспекдекиLLM
Задачи
- •Исследовать и реализовывать новые RL-подходы для оптимизации ревордов
- •Обучать и совершенствовать SFT/align-модели
- •Разрабатывать и внедрять методы оптимизации инференса (квантование, дистилляция, спекдеки)
- •Интегрировать мультимодальные данные (картинки, видео) в пайплайны ответов
- •Выявлять точки роста, формализовать задачи и согласовывать работу со смежниками
Обязательно
- •Понимание устройства LLM и процесса их обучения
- •Знание классического DL и ML методов
- •Умение писать код на Python
- •Готовность читать научные статьи и решать сложные исследовательские задачи
Будет плюсом
- •Опыт работы с RL-методами
- •Реализация оптимизаций или продакшн-инференса моделей