Data Scientist (Управление моделирования партнерств и ИТ-процессов)
гибрид, Москва
Работа в команде моделирования для разработки и внедрения предиктивных моделей и LLM-инструментов, которые повышают эффективность партнерских решений и автоматизируют ИТ‑процессы. Включает подготовку данных, расширение моделей на новые сегменты и автоматизацию переобучения
Стек
PythonPyTorchHadoopSparkpandasnumpyscikit-learnLightGBMSQLHiveImpalapysparkgitnetworkxlangflowLLM
Задачи
- •анализ и интеграция новых источников данных для моделей
- •разработка, улучшение и расширение моделей на дополнительные сегменты
- •настройка и автоматизация переобучения моделей
- •анализ неструктурированных данных и применение LLM
- •взаимодействие с заказчиками и участие в тестировании и проектной документации
Обязательно
- •высшее техническое образование
- •знание методов машинного обучения и анализа данных
- •уверенные навыки Python и стандартных библиотек (pandas, numpy, matplotlib, scipy, scikit-learn, LightGBM)
- •опыт работы с большими данными: Hadoop, Hive/Impala, Spark
- •знание SQL и pyspark
- •умение читать техническую и научную литературу на английском