Инженер эксплуатации систем мониторинга и алертинга, middle
офис, удалёнка, гибрид, Екатеринбург
Инфраструктурная команда поддерживает системы телеметрии и алертинга. Инженер будет развивать и эксплуатировать стек мониторинга (сбор метрик, дашборды, алерты), повышать отказоустойчивость и помогать командам разработки в вопросах наблюдаемости сервисов
ГрейдMiddle
Опыт1–3 года
Стек
KubernetesHelmVictoriaMetricsGrafanaGraphiteMoiraSentryKibanaAnsibleCI/CDGitLinux
Задачи
- •Развивать и администрировать стек сбора метрик и алертинга (Grafana, Graphite, VictoriaMetrics, Moira)
- •Повышать отказоустойчивость и масштабируемость системы
- •Разворачивать и поддерживать решения в Kubernetes, писать и дорабатывать Helm-чарты
- •Осуществлять миграции и обновления компонентов мониторинга
- •Разбираться с инцидентами, анализировать причины по логам и метрикам
- •Взаимодействовать с командами разработки по вопросам наблюдаемости сервисов
Обязательно
- •Администрирование Linux, управление сервисами и работа по SSH (от 2 лет)
- •Практический опыт работы с Kubernetes и написание Helm-чартов
- •Опыт построения CI/CD пайплайнов
- •Опыт администрирования систем телеметрии: Grafana, VictoriaMetrics, Sentry, Kibana
- •Знание Ansible: написание ролей и плейбуков
- •Уверенная работа с Git
- •Понимание принципов отказоустойчивости распределённых систем