Ведущий дежурный администратор
офис, Москва
Работа в Ситуационном центре по мониторингу и поддержке ИТ‑инфраструктуры, сервисов и корпоративных хранилищ данных. Обеспечение доступности сервисов, первичная диагностика инцидентов, координация устранения и расчёт SLA для критичных систем.
ГрейдMiddle
Стек
ZabbixPrometheusGrafanaClickHouseApache AirflowJiraConfluenceVisiology
Задачи
- •Мониторинг работоспособности ИТ‑инфраструктуры, сервисов и КХД
- •Первичный анализ и диагностика инцидентов, включая инфраструктурные и КХД
- •Координация работ по устранению инцидентов и взаимодействие со смежными командами
- •Контроль сроков решения инцидентов, консолидация и анализ отчётности по сбоям
- •Расчёт SLA критичных информационных систем
- •Внедрение и актуализация мониторинга: создание дашбордов, триггеров и оповещений; сопровождение BI и ETL процессов
Обязательно
- •Знание Zabbix, Prometheus и Grafana
- •Уверенное понимание процессов управления инцидентами, проблемами и изменениями (ITIL) и SLA
- •Базовые навыки администрирования Linux и Windows
- •Умение писать SQL‑запросы и понимание принципов работы СУБД
- •Навыки настройки дашбордов, триггеров и оповещений в системах мониторинга
- •Знание мониторинга BI‑систем (Visiology) и ETL‑процессов
Будет плюсом
- •Опыт работы с DWH RS‑DataHouse (R‑Style)
- •Опыт с ClickHouse
- •Опыт с Apache Airflow
- •Опыт работы с Debezium или другими CDC
- •Опыт с Superset