Аналитик данных
офис, гибрид, Москва
Команда данных Казначейства отвечает за распределённое хранилище и аналитические витрины, поддерживающие ключевые финансовые процессы банка. Вы будете проектировать витрины и модели данных, обеспечивать ETL/ELT-пайплайны и производительный доступ к большим объёмам данных
Стек
Apache SparkPostgreSQLHDFSHadoopSQL
Задачи
- •Проектирование витрин данных под задачи финансового анализа
- •Проектирование и доработка моделей данных
- •Проектирование и поддержка ETL/ELT-процессов
- •Анализ источников данных и их взаимосвязей
- •Оптимизация SQL-запросов и обеспечение производительности при больших объёмах данных
Обязательно
- •Уверенное владение SQL (PostgreSQL) и опыт написания сложных запросов (JOIN, CTE, оконные функции)
- •Понимание принципов оптимизации SQL-запросов
- •Опыт работы с большими объёмами данных
- •Опыт работы с Apache Spark (Spark SQL или PySpark)
- •Базовое понимание экосистемы Hadoop, HDFS и принципов партиционирования
- •Опыт проектирования витрин данных и моделирования данных
- •Понимание ETL/ELT-процессов и жизненного цикла данных; навыки анализа данных (Excel, pandas)