Руководитель ИТ инфраструктуры и эксплуатации
Москва
Руководство командой эксплуатации, отвечающей за облачную и физическую инфраструктуру критичных сервисов платформы, интегрированной с банками и финансовыми партнёрами. Обеспечите SLA/SLO, отказоустойчивость, безопасность и оптимизацию затрат при росте нагрузки
ГрейдSenior/Lead
Опытот 10 лет
Стек
PythonKubernetesTerraformPrometheusDockerAnsibleLinuxWindows
Задачи
- •Разработка и реализация стратегии развития эксплуатации и инфраструктуры
- •Руководство и развитие команды инженеров (наём, обучение, оценка)
- •Построение и оптимизация процессов мониторинга, инцидент- и change-менеджмента
- •Автоматизация инфраструктуры и CI/CD, внедрение практик SRE/DevOps
- •Обеспечение SLA/SLO, резервного копирования и disaster recovery
- •Управление бюджетом инфраструктуры и контроль затрат на облако
Обязательно
- •Опыт эксплуатации ИТ‑инфраструктуры от 10 лет
- •Опыт работы на руководящей позиции от 5 лет
- •Глубокие знания облачных платформ и сетей
- •Опыт с Linux и Windows серверами
- •Опыт контейнеризации и оркестрации (Docker, Kubernetes)
- •Опыт построения процессов мониторинга и инцидент-менеджмента (Prometheus/Grafana/Zabbix)
- •Знание IaC и автоматизации (Terraform, Ansible)
Будет плюсом
- •Практический опыт с AI/LLM-инструментами и внутренними AI-платформами
- •Опыт маршрутизации запросов к LLM и управления квотами/расходами