Старший DevOps инженер
Команда развивает единую платформу для разработки, развертывания и эксплуатации решений на основе LLM и агентской платформы в закрытых контурах банка. Роль отвечает за доступность, CI/CD, оркестрацию и сопровождение сервисов в Kubernetes, чтобы перевести пилоты в промышленную эксплуатацию
ГрейдSenior
Опытот 2 лет
Стек
PythonKubernetesDockerHelmTeamCityArgoCDGrafanaPrometheusGitLinuxBash
Задачи
- •Обеспечение доступности и надёжности приложений в Kubernetes на всех средах
- •Работа с инцидентами: реагирование, эскалация, post-mortem и дежурства
- •Создание и изменение CI/CD пайплайнов и Docker-образов
- •Разработка и поддержка umbrella Helm-чартов
- •Создание алёртов и работа с мониторингом/логированием (Grafana/Prometheus)
- •Исследование и внедрение нового функционала (R&D) и новых приложений
Обязательно
- •практический опыт работы с Kubernetes и понимание архитектуры кластера
- •опыт прикладного использования Kubernetes — от 2 лет
- •опыт отладки приложений в Kubernetes и поиска причин в инфраструктуре
- •опыт сборки контейнерных образов и знание best practices
- •опыт работы с Helm — от 1 года
- •опыт создания и изменения CI/CD пайплайнов (TeamCity/ArgoCD)
- •навыки автоматизации на bash и Python и хорошее знание Linux
Будет плюсом
- •опыт LLMOps: развертывание inference-серверов (vLLM, TGI, Triton)
- •оркестрация LLM-пайплайнов (LangChain, Haystack)
- •опыт работы с Langfuse и LLM backends (SSO, трейсинг, сбор обратной связи)
- •понимание ML-инструментов и жизненного цикла моделей (MLflow, Kubeflow, Model Registry)
- •опыт нагрузочного тестирования LLM-эндпоинтов и продвинутый Prometheus/PromQL