ML-разработчик (Inference)

200,000 - 350,000 RUB

Описание роли

В Yandex Cloud открыта позиция Senior ML-инженера (Inference). Как ML-инженер вы будете реализовывать и оптимизировать системы инференса LLM, обеспечивая высокую производительность и масштабируемость на GPU-кластерах. Ваша работа напрямую влияет на качество сервисов генерации и обработки текста, которые используют миллионы пользователей. Вы сможете применять передовые подходы к ML, участвовать в формировании архитектуры и тесно взаимодействовать с продуктовой и исследовательской командами.

Ваши основные задачи:
* Оптимизация throughput и latency генерации LLM с помощью speculative decoding, continuous batching и KV-cache.
* Тюнинг и профилирование фреймворков PyTorch, TensorRT, vLLM, включая написание кастомных CUDA/Triton-ядр.
* Проектирование распределённых систем инференса, интеграция с Kubernetes, сервис-мешами, балансировщиками и автоматическим масштабированием.
* Разработка API, SDK и инструментов для автоматизации развёртывания и обновления моделей на on-prem и облачной инфраструктуре.
* Работа с NVLink, RDMA и другими технологиями ускорения, оптимизация памяти и вычислений.

Уникальность вакансии

Вы получите доступ к инновационной платформе Yandex Cloud, где внедряются передовые подходы к infеренсу LLM. Среди преимуществ:
* Гибридный формат работы между офисом в Москве и удалёнкой.
* Использование современных технологий: CUDA, TensorRT, PyTorch, Kubernetes.
* Возможность влиять на стратегию развития AI-сервисов и масштабировать решения до тысяч узлов.
* Доступ к внутренним R&D-проектам и участие в ML-конференциях, обмен опытом с экспертами.
* Карьерный рост до роли Tech Lead или архитектора распределённых систем.

О компании

Yandex — лидер в области интернет-технологий и цифровых сервисов. Миссия компании — создавать удобные и эффективные решения на базе искусственного интеллекта, которые делают жизнь пользователей проще. Yandex Cloud предоставляет масштабируемую облачную инфраструктуру и управляемые ML-сервисы для крупных корпораций и стартапов. Компания инвестирует в исследовательские проекты, открывает доступ к вычислительным ресурсам и развивает экосистему разработчиков по всему миру. В коллективе ценятся инновации, открытость и профессиональный рост.

Присоединяйтесь к команде Yandex Cloud как ML-инженер и погружайтесь в мир infеренс LLM, GPU оптимизация и облачные технологии.

Оценка вакансии
4.9 / 10
Вакансия Senior ML-разработчика (Inference) в Yandex Cloud предлагает работу с передовыми LLM-инференс технологиями и оптимизацией GPU. Инновационная платформа и гибридный формат обеспечивают интересные задачи и перспективы роста до Tech Lead. Отличается масштабируемыми проектами и сильной командой.
Опубликовано:

Будьте в курсе новых вакансий

Подпишитесь на наш Telegram-канал