Старший LLM-разработчик в команду Нейро
Команда Нейро развивает систему поиска и ассистентов на основе больших моделей. Вы будете создавать и улучшать модели-оценщики и реворд-модели для повышения достоверности и качества ответов пользователей
ГрейдSenior
Стек
PythonTransformersReinforcement LearningSFT (Supervised Fine-Tuning)NLPDeep LearningInference optimization
Задачи
- •Разработка и улучшение реворд-моделей для оценки ответов
- •Обучение и внедрение LLM-ассессоров и агентов для фактчекинга и разметки
- •Эксперименты по сжатию моделей и ускорению инференса
- •Применение SFT, RL и других современных методов для улучшения качества генерации
Обязательно
- •Знание Python
- •Хорошее понимание классического Deep Learning и NLP
- •Опыт решения NLP-задач с трансформерами
- •Понимание архитектур современных LLM и опыт их прикладного или исследовательского использования