SRE-инженер (ЦОД)
Москва
Команда SRE отвечает за эксплуатацию платформы в распределённых дата‑центрах: поддержка OKD-кластеров, развёртывание релизов, мониторинг и реагирование на инциденты в рабочее время. Роль важна для стабильности сервисов и доступности продуктов для пользователей
ГрейдJunior/Middle
Опыт1–3 года
Стек
KubernetesDockerLinuxBare MetalOKD
Задачи
- •Поддержка высоконагруженных кластеров OKD
- •Установка релизов ПО на распределённую сеть дата‑центров
- •Мониторинг платформенных и продуктовых сервисов
- •Реагирование на инциденты в рабочее время (с 10:00 до 19:00, без дежурств)
- •Коммуникация с командами продуктов и платформы для решения инцидентов
- •Выезды и работы на площадке в ЦОД по графику
Обязательно
- •Опыт работы на аналогичной позиции от 2-х лет
- •Опыт работы с K8S, Linux, Docker
- •Опыт работы с высоконагруженной инфраструктурой на Bare Metal
- •Поддержка высоконагруженных кластеров OKD
- •Навыки мониторинга и реагирования на инциденты
- •Готовность поездкам в ЦОД 3 раза в неделю