Lead SRE
удалёнка, Москва
Ведущий SRE в команде эксплуатации платформы: поддержка высоконагруженных кластеров, развёртывание релизов в распределённой сети дата‑центров и обеспечение наблюдаемости для быстрой реакции на инциденты и стабильности сервисов
ГрейдLead
Опытот 3 лет
Стек
KubernetesDockerHelmGitLab CILinuxAnsibleCI/CDIaCGitOpsObservabilityMLTCloud Architecture
Задачи
- •Руководство группой системных инженеров до 5 человек
- •Поддержка и эксплуатация высоконагруженных кластеров
- •Установка и координация релизов ПО в распределённой сети дата‑центров
- •Мониторинг платформенных и продуктовых сервисов
- •Реагирование на инциденты в рабочее время (10:00–19:00)
- •Коммуникация с командами продуктов и платформы для решения инцидентов
Обязательно
- •Опыт работы в SRE от 3 лет
- •Опыт руководителя/лидера DevOps или SRE от 1 года
- •Практический опыт с Kubernetes, Linux, Docker и Helm
- •Опыт с CI/CD и GitLab CI
- •Опыт с Ansible, IaC и GitOps
- •Опыт в Observability, MLT (metrics, logs, traces)
- •Готовность работать на территории заказчика 3–4 дня в неделю