Data Analyst
офис, Москва
Команда ДИТ работает над витринами данных на базе Hadoop/Spark для продуктового анализа кредитов физлиц. Роль подразумевает проектирование витрин, написание и оптимизацию сложных SQL-запросов и обеспечение качества данных для бизнес-решений.
ГрейдMiddle/Senior
Опытот 3 лет
Стек
SQLApache SparkHDFSImpalaParquetAvroData VaultHive
Задачи
- •создание прототипов витрин данных и проектирование логики витрин
- •написание и оптимизация сложных SQL-запросов для анализа и верификации данных
- •подготовка ТЗ и описание ELT/ETL-процессов на Spark
- •обеспечение качества, целостности и логики данных, мониторинг здоровья витрин
- •взаимодействие с заказчиками и командами разработки, документирование решений
Обязательно
- •высшее образование
- •опыт работы от 3 лет
- •продвинутый SQL (сложные запросы, оконные функции, join, подзапросы) в Hive/Impala
- •знание Hadoop экосистемы: HDFS, партиционирование, форматы Parquet/Avro
- •опыт моделирования данных (Data Vault, 3NF, dimensional modeling)
- •опыт подготовки ТЗ на ETL/ELT для Spark
- •опыт работы с Jira и Confluence
Будет плюсом
- •навыки работы с генеративными AI-моделями
- •опыт разработки и использования AI-агентов
- •опыт работы с GigaChat, Kandinsky и аналогами