Инженер SRE
гибрид, Москва
Команда эксплуатации поддерживает высоконагруженный рекомендательный движок и отвечает за стабильность сервисов, масштабирование и быстрый отклик на инциденты. Вы будете работать с CI/CD, мониторингом и инфраструктурой, влияющей на пользовательский опыт продукта.
ГрейдJunior/Middle
Опыт1–3 года
Стек
PythonKubernetesPostgreSQLGitLabPrometheusLokiGrafanaTerraformHelmDockerMongoDBRedisJenkinsArgoCDGitAirflowSpark
Задачи
- •Поддерживать работоспособность инфраструктуры решения по выдаче рекомендаций
- •Развёртывать сервисы на тестовые и продовые стенды через CI/CD (GitLab, Jenkins, ArgoCD)
- •Мониторить системы и анализировать алерты и логи (Prometheus, Loki, Grafana)
- •Участвовать в расследовании инцидентов и дежурствах (on-call)
- •Вносить изменения через IaC (Terraform, Helm) по шаблонам
- •Автоматизировать рутинные операции скриптами на Python
Обязательно
- •высшее образование
- •опыт администрирования Linux от 1 года, уверенная работа в CLI
- •базовый практический опыт с Docker и Kubernetes (Pod, Service, Ingress, ConfigMap)
- •знание Git и CI/CD инструментов
- •понимание PostgreSQL и принципов работы MongoDB/Redis на уровне простых запросов и проверки доступности
- •умение читать код на Python и писать простые скрипты
- •готовность к дежурствам второй линии 3–4 раза в месяц и участие в Incident Response
Будет плюсом
- •опыт настройки мониторинга в Prometheus и визуализации в Grafana
- •опыт запуска сборок в GitLab или Jenkins