инженер технической поддержки LLM-сервисов
ориентир по рынку
вакансия
зп не указана
в среднем
173 946 ₽
мэтч
Загрузи резюме, чтобы видеть мэтчи с вакансией
Загрузить
Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
загрузить резюме
задачи
Сопровождать виртуальные машины и контейнерные среды Kubernetes для инфраструктуры ML/LLM; Мониторить распределение ресурсов CPU/RAM/GPU; Диагностировать узкие места в инференсе моделей; Поддерживать стек Prometheus, VictoriaMetrics и Grafana; Писать запросы на PromQL и SQL для диагностики состояния сервисов; Настраивать SLO/SLI; Создавать дашборды для отслеживания задержки, пропускной способности и ошибок LLM; Сопровождать микросервисы и распределённую архитектуру; Трассировать запросы между сервисами; Анализировать логи при инцидентах; Оперативно реагировать на алерты; Проводить RCA; Разрабатывать инструкции для типовых сценариев отказов; Отлаживать API-запросы к LLM; Диагностировать ошибки токенизации, ограничения частоты запросов и тайм-ауты; Писать Python-скрипты для автоматизации диагностики и сбора метрик; Перезапускать зависшие задачи; Парсить логи; Взаимодействовать с командами разработки и инфраструктуры при сложных инцидентах; Передавать задачи в установленные сроки.
требования
Высшее образование; Опыт работы от года; Понимание принципов работы виртуальных машин и контейнеризации; Умение анализировать распределение ресурсов; Уверенное владение Prometheus и Grafana; Умение писать запросы на PromQL; Понимание метрик инференса: latency p95/p99, GPU utilization, queue size; Знание Loki для анализа логов и метрик; Базовое понимание векторных баз данных; Знание Python для автоматизации и написания диагностических скриптов; Понимание работы LLM-сервисов, инференса, токенов и контекстного окна; Аналитические способности и системное мышление; Умение работать с большими объёмами информации и в режиме многозадачности; Умение принимать самостоятельные решения; Нацеленность на результат; Хорошие навыки письменной и устной коммуникации; Английский B1; Будет плюсом опыт работы с движками LLM-инференса vLLM и SGLang, знание LangChain и LangFlow для понимания цепочек вызовов моделей, знание английского для чтения технической документации.
условия
Условия обсуждаются индивидуально; Пятидневный график.
Если просят выйти из iCloud, прислать код из SMS, запустить или установить что-то, перевести деньги — не соглашайтесь: это мошенничество.
Про зарплаты
Анонимные данные по зарплатам и грейдам. Можно сверить вилку с рынком.
Посмотреть зарплаты
статьи для DevOps-инженеров