Старший DL-разработчик в команду разработки агентов и функций Alice AI LLM
гибрид
Команда разработки агентов и функций Alice AI LLM работает над обучением моделей применять внешние инструменты, действовать в браузере и работать в мультиагентных сценариях. Вы будете собирать датасеты, строить интерактивные среды и тренировать распределённые трансформерные модели для повышения качества и надежности агентов
ГрейдSenior
Стек
PythonTransformervLLMReinforcement LearningPPOGAEGRPOSGLangVERL
Задачи
- •Сбор и разметка данных и интерактивных сред для обучения агентных навыков
- •Разработка и запуск экспериментов по RL для обучения поведения агентов
- •Тренировка больших Transformer-моделей в распределённой среде
- •Интеграция и оценка использования внешних инструментов и браузера в сценариях агентов
- •Улучшение reasoning-способностей моделей (верификация, рефлексия, бэктрекинг)
Обязательно
- •Отличное знание математики, алгоритмов и структур данных
- •Умение программировать на Python
- •Опыт и понимание методов Reinforcement Learning (GAE, PPO, GRPO и др.)
- •Практический опыт в распределённом обучении больших моделей на основе Transformer
- •Понимание этапа alignment современных LLM
Будет плюсом
- •Опыт обучения LLM навыкам использования внешних инструментов (tool calling, function calling)
- •Опыт работы с инфраструктурой для RL-обучения: vLLM, SGLang, VERL и т.п.