Главный инженер MLOps
Команда отвечает за платформу вывода ML-моделей в production: разворачиваете и оптимизируете inference-сервисы в Kubernetes, обеспечиваете масштабирование, отказоустойчивость и наблюдаемость, ускоряя переход экспериментов в рабочие сервисы
ГрейдLead
Опытот 3 лет
Стек
KubernetesHelmTerraformArgoCDCI/CDGitOpsMonitoringML-inference servers
Задачи
- •Разворачивать и поддерживать ML-инфраструктуру в Kubernetes
- •Проектировать и оптимизировать инфраструктуру для ML/LLM inference
- •Автоматизировать развертывание моделей и сервисов с Helm, ArgoCD и CI/CD
- •Разрабатывать и поддерживать Terraform-модули для облачной инфраструктуры
- •Развивать мониторинг, логирование и алертинг для ML-систем
- •Сотрудничать с ML и backend-командами для вывода решений в production
Обязательно
- •опыт 3+ лет в DevOps/MLOps или ML-разработке
- •владение Kubernetes
- •навыки работы с Helm и ArgoCD
- •опыт настройки CI/CD и GitOps-подходов
- •написание и поддержка Terraform-модулей
- •практика работы с мониторингом, логированием и ML-inference серверами
- •знание облачных технологий