Data Engineer
офис, Москва
Команда по работе с данными в зоне КАПа, ответственна за ETL-пайплайны и витрины по банковским карточным продуктам и платежам. Задача — обеспечить качество, актуальность и доступность данных для аналитики и бизнес-процессов
Стек
SQLApache SparkHDFSGitJavaScalaPythonLinux bash
Задачи
- •Проектирование и разработка ETL-потоков и витрин данных
- •Анализ и оптимизация существующих ETL процессов
- •Обеспечение качества и актуальности данных
- •Верификация задач аналитиков (Source-to-Target)
- •Поддержка внедрения функционала на этапах ПСИ и ОПЭ
Обязательно
- •глубокие знания SQL
- •владение Apache Spark и HDFS на высоком уровне
- •опыт промышленной реализации ETL-процессов и построения витрин
- •опыт работы с Java/Scala/Python
- •понимание устройства хранилищ данных (DWH) и подходов к оптимизации
- •опыт работы с большими объёмами данных
- •навыки работы с git и Linux bash
Будет плюсом
- •опыт работы с генеративными AI-моделями
- •опыт создания и использования AI-агентов в продуктах