Если вы раньше входили через Google, сбросьте пароль для своей Gmail-почты через кнопку «Забыли пароль?» на экране входа. Затем войдите по email и новому паролю.
Если аккаунта ещё нет, зарегистрируйтесь с Gmail-почтой, после подтверждения почты мы предложим задать пароль.
Что нового
Загружаю обновления...
Что нового
Загружаю обновления...
Работа найдется быстрее с подпискойКандидат найдётся быстрее с подпиской
Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
ASTON — аккредитованная аутсорсинговая IT-компания, работающая с 2007 года. Она разрабатывает программное обеспечение и IT-решения для сфер финансов, здравоохранения, электронной торговли, интернета вещей, медиа, больших данных и машинного обучения. Роль предполагает работу над проектом заказчика — крупного коммерческого банка, который развивает мобильные сервисы.
задачи
Сопровождать и эксплуатировать платформы Data Lake;
Поддерживать инфраструктуру S3/Object Storage;
Мониторить, диагностировать и устранять инциденты;
Проводить диагностику производительности платформы и систем хранения;
Сопровождать Kubernetes и компоненты Data Lake;
Проводить RCA и анализ инцидентов после их устранения;
Автоматизировать эксплуатационные задачи;
Взаимодействовать с командами Data Engineering и инфраструктуры;
Сопровождать Big Data Platform.
требования
Опыт работы DevOps/SRE Engineer от 3 лет;
Опыт работы в финтех-компаниях;
Экспертный опыт администрирования Linux;
Опыт сопровождения высоконагруженных распределённых систем;
Глубокое понимание S3/Object Storage и архитектуры распределённого хранения;
Опыт сопровождения Kubernetes-платформ;
Практический опыт эксплуатации компонентов Data Lake: Apache Spark, Airflow, Flink, Kafka, Apache Iceberg;
Опыт эксплуатации решений MinIO/Object Storage;
Понимание репликации, кодирования с избыточностью, согласованности и отказоустойчивости;
Практический опыт диагностики CPU, RAM, сети, дискового ввода-вывода, задержки и пропускной способности;
Опыт работы со стеком наблюдаемости: Prometheus, Grafana, оповещения и анализ логов;
Опыт автоматизации с Ansible, Terraform, Bash и Python;
Понимание управления инцидентами и проблемами, а также практик SRE;
Навыки RCA, анализа инцидентов после их устранения и повышения надёжности платформ.