Middle Data Scientist (Time series)
офис, гибрид, Москва
Команда строит индивидуальные модели поведения клиентов и прогнозы временных рядов для розничного бизнеса. Вы будете разрабатывать и продвигать пайплайны обучения и предсказаний на данных Hadoop/PySpark, проверять гипотезы через A/B и повышать экономическую эффективность продуктов.
ГрейдMiddle
Опытот 2 лет
Стек
PythonPySparkHadoopSQLpandasscikit-learnCatBoostPyTorch
Задачи
- •разработка и развёртывание пайплайнов для прогнозов time series и табличных моделей
- •построение индивидуальных моделей эластичности (uplift) и моделей клиентского поведения
- •работа с большими данными в экосистеме Hadoop (выгрузки, преобразования, витрины для моделей)
- •дизайн и оценка A/B-тестов (мэтчинг, продвинутые методы causal inference, интерпретация результатов)
- •внедрение мониторинга и обеспечение надёжности моделей в продакшене
- •коммуникация с заказчиками: согласование метрик и презентация результатов
Обязательно
- •опыт работы Data Scientist от 2 лет
- •уверенное владение Python и ML-библиотеками
- •понимание теории вероятностей и статистики
- •знание ML-алгоритмов: регрессия, классификация, кластеризация и uplift-моделирование
- •опыт работы с SQL и в экосистеме больших данных (Hadoop/PySpark)
- •умение проектировать и оценивать A/B тесты и применять causal inference
Будет плюсом
- •опыт с PyTorch
- •опыт в продакшен-пайплайнах моделей и мониторинге