Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
Проект посвящён развитию и эксплуатации платформы OpenStack для крупного оператора сотовой связи в телеком-сфере.
задачи
Эксплуатировать и развивать production-кластеры OpenStack;
Диагностировать и решать сложные проблемы OpenStack и Linux;
Работать с сетями и виртуализацией;
Настраивать мониторинг и observability;
Автоматизировать процессы и писать скрипты;
Работать с Ceph, SAN и storage;
Участвовать в миграциях, обновлениях и развитии платформы;
Участвовать в дежурствах и управлении инцидентами;
Использовать AI-инструменты для анализа логов, генерации кода и RCA.
требования
Опыт работы с OpenStack от 3 лет именно в production;
Уверенное знание Linux: Ubuntu/Debian, systemd, sysctl, параметры ядра, диагностика через top, vmstat, iostat, sar, tcpdump и strace;
Сильная база по сетям и виртуализации: OVS/OVN, VLAN/VXLAN/Geneve, L2/L3;
Опыт работы с Prometheus, Grafana и Zabbix;
Знание Python и Bash для автоматизации и написания утилит;
Понимание эксплуатации production-инфраструктуры и готовность к дежурствам;
Практический опыт использования LLM/AI-инструментов в работе, реальные примеры и понимание необходимости проверять результат AI;
Будет плюсом опыт с AIOps, AI-агентами, RAG, системами анализа логов и обнаружения аномалий, глубокое знание OpenStack, включая Ironic, Zun и Terraform Provider, опыт миграций между версиями, интеграции OpenStack и Kubernetes, знание Ceph-CSI, Cinder CSI, Multus и SR-IOV, опыт работы с Huawei Dorado/OceanStor и глубокая экспертиза в Ceph, опыт с InfoSec, DevOps/GitOps и Chaos Engineering, опыт работы в крупных инфраструктурах, особенно в телекоме, billing и CRM, а также с 10k+ VM.
условия
Удалённая работа по РФ;
Часовой пояс не более чем ±3 часа от московского времени (UTC+3);