Senior Data Scientist (Time series)
офис, гибрид, Москва
Команда строит персональные модели эластичности и time‑series прогнозы для розничных продуктов, превращая данные в измеримый экономический эффект для бизнеса. Вы будете разрабатывать модели от прототипа до продакшн‑пайплайнов и контролировать их стабильную работу
ГрейдSenior
Опытот 3 лет
Стек
PythonPySparkSQLHadoopnumpyscikit-learnpandascatboostlightgbmxgboostmatplotlibseabornplotly
Задачи
- •обработка и подготовка больших данных в Hadoop/PySpark и написание SQL‑витрин для моделей
- •разработка индивидуальных моделей эластичности и поведения клиентов от прототипа до продакшна
- •прогнозирование time‑series (досрочное погашение и другие метрики)
- •дизайн и оценка A/B‑тестов и применение методов causal inference
- •взаимодействие с заказчиками: согласование метрик и демонстрация ценности моделей
- •обеспечение мониторинга и надежности внедрённых моделей
Обязательно
- •опыт работы Data Scientist от 3 лет
- •уверенное владение Python
- •знание и опыт применения numpy, scikit‑learn, pandas, matplotlib/seaborn/plotly
- •опыт с градиентными бустинг‑библиотеками (catboost, lightgbm, xgboost)
- •понимание теории вероятностей и статистики
- •умение строить и оценивать uplift‑модели и методы причинно‑следственного вывода
- •опыт работы с большими данными и написанием SQL в экосистеме Hadoop/PySpark
Будет плюсом
- •опыт работы с PyTorch
- •выпуск ведущих вузов (МГУ, МФТИ, ВШЭ и др.)