Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
ИТ-подразделение создало платформу данных объёмом в сотни петабайт для крупнейшего подразделения банка. На платформе Hadoop реализована загрузка, обработка и контроль качества данных из сотен банковских систем-источников в единое хранилище на основе архитектуры Data Lakehouse.
задачи
Разрабатывать хранилища данных, Data Lake и Lakehouse;
Строить поставку данных в пакетном режиме, режиме NRT и реальном времени;
Оптимизировать ETL;
Повышать актуальность данных;
Снижать задержку доступа к данным;
Разрабатывать и проверять архитектуру данных;
Разрабатывать и поддерживать витрины данных в Hadoop;
Разрабатывать NRT-пайплайны.
требования
Отлично знать SQL, включая соединения, CTE, оконные функции и фреймы;
Иметь опыт работы с Hadoop, Spark, Iceberg или Paimon;
Иметь опыт работы с Kafka и другими брокерами;
Иметь опыт работы с оркестраторами, например Airflow, и CI/CD;
Иметь опыт построения архитектуры данных, например Data Vault, Инмана или Кимбалла;
Иметь опыт кратного ускорения ETL;
Будет плюсом практическое знание Python на уровне разработки ETL, Java или Scala, опыт создания и защиты архитектуры данных, опыт разработки архитектуры решений для продуктов данных.
условия
Годовая премия;
Корпоративный спортзал и зоны отдыха;
Более 400 образовательных программ СберУниверситета для профессионального и карьерного развития;
Регулярные митапы и развитое сообщество специалистов по данным;
Расширенная ДМС, льготное страхование для семьи и корпоративная пенсионная программа;
Скидка по ипотечному кредиту в размере 1/3 ключевой ставки ЦБ;
Подписка Прайм с возможностью совместного использования с тремя близкими;
Вознаграждение за рекомендацию друзей в команду Сбера.