LLM Engineer / Inference Engineer (Центр Практического ИИ)
офис, гибрид, Москва
Команда Центра практического ИИ работает над обучением, оптимизацией и запуском LLM для банковских сценариев в закрытых контурах с жесткими SLA. Роль включает полный цикл: подготовка данных, дообучение, оценка качества, оптимизация инференса и внедрение в production.
ГрейдSenior
Опытот 3 лет
Стек
PythonGPU-ClusterWeights & BiasesMLflowLangfuse
Задачи
- •подготовка и очистка датасетов для pre-training и fine-tuning
- •обучение и дообучение LLM на GPU-кластерах
- •анализ экспериментов и улучшение качества моделей по метрикам
- •оптимизация инференса и подготовка к нагрузочному тестированию
- •внедрение и хостинг моделей в production в закрытых контурах
Обязательно
- •подтвержденный практический опыт обучения LLM (pre-training, fine-tuning, alignment)
- •глубокое понимание архитектуры LLM, токенизации, пайплайнов, batching и mixed precision
- •опыт распределённого обучения и отладки неудачных итераций
- •опыт разработки на Python от 3 лет
- •написание чистого и поддерживаемого кода
- •внимание к деталям и умение коммуницировать в команде
Будет плюсом
- •опыт разработки AI-агентов (tool-using, planning, multi-step workflows)
- •знание инструментов логирования экспериментов (Weights & Biases, MLflow, Langfuse)
- •опыт оптимизации инференса и хостинга моделей в production
- •дизайн и поддержка eval-пайплайнов с метриками и проверками на регрессию