MLE
удалёнка, гибрид, Москва
Команда разработки ML-инфраструктуры для внедрения LLM и NLP-решений. Разработка ML-бэкендов и микросервисов, оптимизация инференса и интеграция с сервисами — чтобы обеспечить производительные и масштабируемые GenAI-продукты
ГрейдSenior
Опытот 2 лет
Стек
PythonFastAPISQLDockerCI/CDONNXOpenVINOTensorRTvllmTriton Inference Server
Задачи
- •Проектирование архитектуры приложений с использованием LLM
- •Разработка ML-бэкендов и микросервисов
- •Интеграция и согласование решений со смежными командами
- •Оптимизация инференса и управления нагрузкой
- •Внедрение и оценка эффективности NLP/LLM-решений
Обязательно
- •Опыт работы в роли MLE от 2 лет
- •Разработка моделей ML в области NLP
- •Уверенное знание Python и разработка сетевых/асинхронных приложений
- •Опыт внедрения решений на основе современных NLP/LLM и руководство проектами
- •Широкая насмотренность в LLM и опыт с RAG
- •Знание Docker, CI/CD, FastAPI и SQL
- •Опыт оптимизации инференса (ONNX, OpenVINO, TensorRT)
Будет плюсом
- •Опыт topic modeling, NER и кластеризации
- •Опыт SSL, few-shot / unsupervised learning
- •Участие во внедрениях GenAI-проектов