Инцидент-менеджер
офис, Москва
Команда сопровождает высокопроизводительную инфраструктуру суперкомпьютеров. Роль отвечает за регистрацию, координацию и расследование инцидентов, подготовку отчётности и улучшение ITSM-процессов для поддержания доступности сервисов и соблюдения SLA
ГрейдMiddle/Senior
Опытот 3 лет
Стек
Jira Service ManagementGrafanaPrometheusELK/OpenSearchConfluenceZabbixExcel
Задачи
- •регистрировать, классифицировать и приоритизировать инциденты в ITSM
- •оперативно реагировать на массовые и критичные инциденты, оценивать бизнес-влияние
- •координировать участников устранения и проводить аварийные встречи
- •вести хронологию, протоколы и фиксировать договорённости по инцидентам
- •инициировать и проводить post-mortem, формировать план корректирующих мероприятий
- •анализировать метрики инцидентов (SLA, MTTR, MTTD) и готовить регулярную отчётность
Обязательно
- •коммерческий опыт от 3 лет в роли инцидент-менеджера
- •высшее техническое образование
- •знание и практика ITIL/ITSM в управлении инцидентами и проблемами
- •опыт работы с ITSM/тикетинг-системами (Jira Service Management)
- •понимание систем мониторинга и умение читать дашборды (Grafana, Zabbix, Prometheus)
- •знание принципов SLA/SLO и показателей MTTR/MTTD
- •навыки координации нескольких команд и стейкхолдеров
Будет плюсом
- •сертификаты ITIL Foundation, ISO 20000, COBIT
- •понимание SRE/DevOps и микросервисной архитектуры
- •знание сетей, Linux и архитектуры высоконагруженных систем
- •опыт работы с генеративным AI и созданием AI-агентов
- •английский для чтения технической документации