Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
Россия, Беларусь
Проект связан с производством.
задачи
Поддерживать и развивать CI/CD-пайплайны для data-инфраструктуры;
Организовывать и сопровождать Kubernetes-кластер, включая деплойменты и Helm-чарты;
Настраивать и поддерживать инфраструктуру для работы с DWH, Lakehouse и Streamhouse;
Поддерживать и администрировать вычислительные движки Trino, Flink, StarRocks и Spark;
Работать с системами хранения Apache Iceberg, Paimon, Parquet, ORC и S3 (MinIO);
Настраивать CDC-процессы для сбора и синхронизации данных;
Мониторить и логировать сервисы, устранять инциденты;
Автоматизировать рутинные задачи управления экспериментальными окружениями на 20+ машинах;
Взаимодействовать с data-инженерами и аналитиками для обеспечения стабильности и прозрачности процессов.
требования
Опыт работы с Kubernetes, деплойментами и Helm;
Опыт работы с системами CI/CD;
Опыт администрирования и настройки вычислительных фреймворков Spark, Flink или аналогов;
Опыт работы с хранилищами данных Iceberg, Paimon или аналогами;
Опыт работы с S3-совместимыми системами хранения MinIO или AWS S3;
Навыки автоматизации с Bash, Python, Groovy и другими инструментами;
Знание Git и опыт работы с GitLab, Jira и Confluence;
Понимание принципов DWH и потоковой обработки данных;
Английский на уровне чтения технической документации;
Будет плюсом опыт настройки CDC, знание Terraform или Ansible, опыт работы с Trino и StarRocks, опыт построения архитектур Lakehouse и Streamhouse, знание Big Data-стека, Paimon/Iceberg, Spark/Flink и ClickHouse.