Инженер данных
удалёнка
Команда развивает и поддерживает корпоративное хранилище данных (DWH) банка. Вы будете строить и оптимизировать ETL/ELT‑процессы, улучшать производительность запросов и поддерживать стабильные пайплайны данных для аналитики и бизнес‑решений.
ГрейдJunior/Middle
Опытот 2 лет
Стек
PythonApache SparkOracleHadoopS3AirflowParquetPL/SQLGitJiraConfluence
Задачи
- •Разработка и оптимизация ETL/ELT‑процессов для DWH
- •Анализ и доработка существующих решений на Spark/Hadoop/Parquet
- •Писать и оптимизировать сложные SQL/PLSQL‑запросы, функции и процедуры
- •Автоматизация задач и пайплайнов с помощью Python и CI/CD
- •Внедрение практик оптимизации запросов, секционирования и индексирования
- •Поддержка документации в Confluence и работа с версионным контролем
Обязательно
- •Опыт работы Data Engineer с DWH от 2 лет
- •Уверенное владение SQL и PL/SQL (JOIN, CTE, WINDOW, MERGE, функции, процедуры)
- •Опыт работы с ETL/ELT‑процессами и базами данных Oracle
- •Практический опыт с Apache Spark, Hadoop, S3, Airflow и форматом Parquet
- •Опыт работы с Git, Jira и Confluence
- •Умение разбираться в чужом коде и бизнес‑логике, самостоятельность и проактивность
Будет плюсом
- •Опыт в банковской сфере или крупных финтех‑проектах
- •Знакомство с Apache Iceberg
- •Навыки проведения code review
- •Знание UML или C4‑диаграмм
- •Знание Kafka как дополнительной технологии