SRE в команду Analytics Infrastructure
офис, удалёнка, Москва
Команда отвечает за стабильность и доступность хранилища данных; вы будете поддерживать кластеры аналитической платформы, обеспечивать отказоустойчивость и своевременную готовность данных для бизнес‑отчётности и аналитики
ГрейдMiddle/Senior
Опытот 3 лет
Стек
PythonFlinkTrinoKubernetesRocksDBHAProxyLinuxJava
Задачи
- •Поддержка и настройка Kubernetes‑кластеров для Flink и Trino
- •Обеспечение отказоустойчивости и доступности хранилища данных
- •Наблюдаемость: настройка мониторинга, логирования и алертинга
- •Автоматизация рутинных операций и развертываний
- •Расследование инцидентов и устранение проблем производительности
- •Тестирование и внедрение новых версий компонентов
Обязательно
- •Опыт в роли SRE/DevOps/Infrastructure/бэкенд-инженера от 3 лет
- •Уверенная работа с Linux и продовыми системами, траблшутинг
- •Опыт поддержки Kubernetes‑кластеров и оптимизации конфигурации
- •Знание и поддержка Flink и/или Trino в проде
- •Умение программировать на Python или Java
- •Опыт работы с мониторингом, логированием и повышением наблюдаемости инфраструктуры
- •Опыт проектирования/поддержки компонентов распределённых систем
Будет плюсом
- •Опыт работы с RocksDB
- •Опыт настройки HAProxy
- •Опыт оптимизации использования ресурсов кластера