Лемана ПРОЛемана ПРО

Инженер по доступности сервисов в команду Observability

Москва

Работа в команде Observability над развитием мониторинга инфраструктуры и приложений: создание зонтичного мониторинга, внедрение SLI/SLO, траблшутинг и автоматизация процессов для повышения надёжности платформенных продуктов

Стек

PythonKubernetesPostgreSQLPrometheusAlertmanagerOpenSearchLokiVectorOpenTelemetryTempoArgoCDJenkinsGitHub/GitLabHelm charts

Задачи

  • Внедрение и развитие инструментов наблюдаемости и метрик
  • Построение мониторинга инфраструктуры и приложений по стандартам компании
  • Создание зонтичного мониторинга процессов компании
  • Работа с SLI/SLO, настройка и сопровождение показателей надежности
  • Траблшутинг инцидентов, автоматизация и шаблонизация действий при инцидентах
  • Консолидация экспертизы и взаимодействие с платформенными командами и командами разработки

Обязательно

  • Знание и опыт работы с Kubernetes
  • Опыт мониторинга: Prometheus и Alertmanager
  • Опыт работы с системами логирования: OpenSearch или Loki или Vector
  • Опыт с Distributed Tracing: OpenTelemetry и/или Tempo
  • Навыки написания и ревью скриптов (Python, Bash, Go)
  • Понимание SLI/SLO/SLA
  • Опыт работы с CI/CD и инструментами: ArgoCD, Jenkins, GitHub/GitLab и Helm charts

Будет плюсом

  • Опыт с GrafanaOnCall
  • Опыт с Mimir
  • Опыт работы с Sentry
  • Опыт с PostgreSQL
  • Опыт с MongoDB
  • Опыт с load‑balancer/reverse proxy (Nginx, HaProxy)
  • Опыт с публичными облаками (Yandex Cloud, Cloud.ru)
  • Опыт с service‑mesh (Istio)
  • Опыт тестирования отказоустойчивости и нагрузочного тестирования
Откликнуться на сайте компании

Похожие вакансии

YADROYADRO

Lead DevOps / TATLIN.UNIFIED

CI/CDRelease Managementмониторингуправление артефактами

Платформенная CI/CD-платформа для унифицированных релизов

офис, удалёнка, гибрид, Москва
ЯндексЯндекс

Разработчик платформы и sandbox-инфраструктуры для обучения AI-агентов

GoKubernetesDockerPython

Платформа для безопасного запуска и масштабирования сред обучения AI‑м

офис, гибрид, Санкт-Петербург
Правительство МосквыПравительство Москвы

Инженер Linux (DevOps)

Python/GoDockerKubernetesCI/CD

Инфраструктура видеонаблюдения и платформенные сервисы для города

гибрид, Москва
Правительство МосквыПравительство Москвы

DevOps-инженер (Senior)

KubernetesOpenShiftCeph (Rook)GitLab

Платформенные решения для контейнеризации и хранения данных

гибрид, Москва
МТСМТС

Lead Product SRE в Скоринг [Big Data, МТС Веб Сервисы]

ClickHouseHadoopApache KafkaPrometheus

Платформа надежности и наблюдаемости для Big Data сервисов

Опыт: от 3 лет
гибрид, Москва
Правительство МосквыПравительство Москвы

DevOps-инженер

C#.NETPostgreSQLKubernetes

Инфраструктура и CI/CD для Портала поставщиков

Опыт: 3–6 лет
офис, гибрид, Москва

Смотреть ещё

JobsWave
Найти работу в IT