Senior/Lead SRE
офис, удалёнка, гибрид, Москва
Команда SRE отвечает за приём в эксплуатацию, обеспечение доступности и развитие инфраструктуры Web-приложения. Роль включает настройку мониторинга и CI/CD, работу с инцидентами и поддержку жизненного цикла сервисов для стабильной работы продакшена
ГрейдSenior/Lead
Опытот 3 лет
Стек
LinuxKubernetesPostgreSQLPrometheusVictoria MetricsGrafanaOpenSearchJenkinsAnsibleHelmArgoCDHAProxyNginxKafkaZookeeperConsulPythonJavaScriptClickHouseMongoDB
Задачи
- •приём в эксплуатацию и запуск компонентов и сервисов Web-приложения
- •обеспечение доступности сервисов согласно SLA и решение эскалированных инцидентов
- •развитие и масштабирование инфраструктуры Web-приложения
- •настройка мониторинга и логирования, создание дашбордов и алертов
- •автоматизация и поддержка CI/CD процессов
- •взаимодействие с командами разработки, тестирования и L1/L2, подготовка инструкций
Обязательно
- •опыт поддержки prod-окружений Web‑приложений от 3 лет
- •опыт администрирования Linux от 3 лет
- •опыт работы с сетями (Ethernet) и траблшутинг TCP/IP
- •понимание основ информационной безопасности и работы с сертификатами
- •настройка и поддержка мониторинга/логирования (Victoria Metrics/Prometheus, Grafana, OpenSearch)
- •автоматизация и поддержка CI/CD процессов и lifecycle компонентов
- •опыт построения prod-систем и ввод их в эксплуатацию
Будет плюсом
- •опыт работы с контейнерами и оркестрацией (Docker, Kubernetes)
- •опыт работы с брокерами сообщений (Kafka)
- •опыт работы с ML‑окружением
- •опыт подготовки документации в Confluence
- •знание SLA/SLO/SLI и опыт взаимодействия с L1/L2
- •понимание IaC-подходов