Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
Команда Infrastructure & Operations создаёт PaaS-платформу для работы с Data Services: ClickHouse, Redis/Valkey, PostgreSQL, Kafka и другими хранилищами. Платформа помогает десяткам команд разработки самостоятельно, быстро и безопасно запускать и развивать продукты, а её основной фокус — платформенные решения для ClickHouse и Redis/Valkey.
задачи
Участвовать в архитектурных решениях, проектировании, развитии и эксплуатации PaaS-платформы на базе Kubernetes, включая компоненты ClickHouse и Redis/Valkey;
Автоматизировать жизненный цикл Data Services: развёртывание, масштабирование, миграции, обновления, резервное копирование, репликацию и восстановление;
Создавать и развивать решения самообслуживания для команд разработки;
Стандартизировать и развивать платформенные практики: Service Catalog, SLO/SLA, GitOps и IaC;
Участвовать в устранении инцидентов, анализировать стабильность и производительность платформы;
Развивать платформенные компоненты для ClickHouse и Redis/Valkey;
Формировать стандартные сценарии предоставления и эксплуатации ClickHouse и Redis/Valkey в Kubernetes.
требования
Понимание Kubernetes как платформы: архитектуры control plane и data plane, жизненного цикла объектов, Deployments, StatefulSets, DaemonSets, механизмов контроля и reconciliation;
Уверенное знание Kubernetes storage stack: StorageClass, PVC/PV, особенности stateful-нагрузок, репликации и отказоустойчивости;
Практический опыт эксплуатации и настройки ClickHouse от 3 лет: репликация, шардирование, ClickHouse Keeper, оптимизация запросов и хранения, резервное копирование и восстановление;
Практический опыт эксплуатации Redis или Valkey: репликация, Sentinel или Cluster, механизмы персистентности, переключение при отказах, оптимизация памяти и задержек;
Опыт развёртывания и эксплуатации stateful-операторов Kubernetes для ClickHouse и Redis/Valkey или участия в разработке и настройке собственных операторов;
Опыт работы с Terraform и понимание принципов IaC;
Опыт построения CI/CD-пайплайнов для инфраструктурных компонентов;
Практическое владение подходом GitOps, например Argo CD или Flux, и умение проектировать процессы развёртывания платформенных компонентов;
Понимание процессов разработки программного обеспечения;
Будет плюсом опыт решения эксплуатационных задач, связанных с кластеризацией, высокой доступностью, backup/restore и производительностью других Data Services в Kubernetes, опыт разработки Kubernetes-операторов и контроллеров на Go или Python, опыт работы с multi-tenancy в Kubernetes, знание принципов распределённых систем: CAP, Raft, quorum и consensus, опыт участия в архитектурных обсуждениях и принятии решений при построении PaaS/DBaaS, опыт работы с policy-as-code: OPA, Gatekeeper или Kyverno, экспертиза в observability-стеке: Prometheus, Grafana, VictoriaMetrics и Jaeger, умение строить метрики и алерты для Kubernetes и Data Services, умение находить корневые причины инцидентов, связанных с latency, IO bottlenecks, сетью и потреблением памяти, опыт работы с Helm и проектирования production-чартов.
условия
Работа в аккредитованной IT-компании;
Можно работать из любого города России;
Полностью белая зарплата;
ДМС;
Онлайн-консультации терапевта, невролога, психолога и медицинского агента;
Помощь с выступлениями на конференциях и статьями для Хабра;
Собственный учебный центр с курсами, тренингами и книгами.