Чтобы адаптировать резюме под вакансию или составить сопроводительное письмо, загрузите резюме
описание
Команда разрабатывает базовые технологии для AI-сервисов Yandex Cloud: мультитенантные поисковые и классификационные модели, компоненты Standalone API, функции OpenAI-like Responses и RealTime API, а также технологическую основу для AI Guardrails и SpeechSense.
задачи
Управлять командой ML-разработчиков: проводить performance review и встречи 1-to-1, ставить цели, помогать с карьерным развитием и развивать знания команды;
Декомпозировать продуктовые цели и превращать их в технический roadmap;
Формировать квартальные планы команды и отвечать за их реалистичность и стабильную сходимость;
Разрабатывать и внедрять CI/CD для моделей, процессов код-ревью, тестирования и релизного цикла ML-артефактов;
Представлять R&D-команды в рамках v-team;
Обеспечивать видимость и прозрачность деятельности R&D-команды;
Формировать технические требования и запросы к смежным командам;
Исследовать и разрабатывать SOTA-модели для сценариев RAG, классификации и памяти;
Интегрировать модели в инфраструктуру инференса;
Отвечать за метрики качества моделей, производительность и стабильность бэкендов инференса;
Обеспечивать логирование, мониторинг и покрытие кода тестами;
Писать код до 30–40% времени;
Проводить код-ревью;
Помогать с архитектурой и диагностикой проблем;
Готовить релизы моделей и бэкендов.
требования
Опыт управления ML-командой от одного года;
Глубокое знание современного ML, включая нейросети и трансформеры, с фокусом на NLP, Information Retrieval или Generative AI;
Опыт разработки и вывода в продакшен ML-сервисов с высокими требованиями к надёжности и производительности;
Уверенное владение Python и PyTorch;
Понимание полного жизненного цикла ML-модели: от сбора требований и подготовки данных до эксплуатации в продакшене;
Проактивность и способность самостоятельно формировать технический бэклог и roadmap на основе продуктовых целей;
Будет плюсом использование опенсорс-проектов и контрибьюция в них, опыт работы с C++ и низкоуровневыми оптимизациями CUDA, опыт работы в распределённой команде, готовность выступать публично, писать технические статьи или вести блог.
условия
Прямое влияние на базовые технологии AI-платформы Yandex Cloud;
Высокая техническая автономия и свобода в выборе инструментов;
Возможность выстроить процессы и культуру новой команды с нуля;
Работа в сильной R&D-команде и кросс-функциональных v-team;
Расширенная медицинская страховка с первого месяца работы;
Оплачиваемый больничный — 30 дней в году;
ДМС покрывает чекапы, вакцинацию, стоматологию, коррекцию зрения после года работы, ведение беременности и роды для сотрудниц и жён сотрудников, работающих более двух лет;