Data/ML Engineer
офис, Москва
Команда AI Delivery/Integrations развивает data-пайплайны и DWH для агентских сценариев и кампаний продаж; роль фокусируется на построении ETL/ELT, витрин для аналитиков и продакшен-интеграции ML/LLM решений для повышения эффективности продаж
ГрейдMiddle
Опытот 2–3 лет
Стек
PythonAirflow/Prefect/DagsterPostgreSQLHadoopSQLClickHouseGreenplumHDFSHiveImpalaDockerGitCI/CDS3
Задачи
- •Проектировать DWH модели и структуры данных под продуктовые и аналитические сценарии
- •Строить и поддерживать ETL/ELT пайплайны и оркестрацию с мониторингом и SLA
- •Готовить витрины данных для аналитиков и ML моделей
- •Внедрять RAG: хранение векторов, поиск по embeddings и интеграция с LLM в продакшене
- •Работать с заказчиками: формулировать гипотезы, метрики и анализировать данные
Обязательно
- •от 2–3 лет опыта
- •уверенный Python (ООП, тесты, типизация)
- •продвинутый SQL: сложные запросы, оконные функции, оптимизация
- •опыт построения надежных ETL/ELT и оркестрации (Airflow/Prefect/Dagster) с мониторингом и алертингом
- •опыт практического построения RAG: векторные представления, поиск по embeddings, интеграция с LLM
- •опыт работы с корпоративными хранилищами: PostgreSQL/ClickHouse/Greenplum и семейством Hadoop
- •Linux, Docker, Git и CI/CD; понимание релизного цикла и code review
Будет плюсом
- •опыт с Spark или Flink и оптимизацией джоб под кластер
- •опыт со стриминговыми системами (Kafka или аналог)
- •опыт работы с S3 on-premise
- •опыт оптимизации вызовов LLM: few-shot, chain-of-thought, токен-лимиты, стоимость и латентность