ML-инженер для Online RL
- AI
- Middle
- Полная занятость
- 3-5 лет
Что за роль
В команде, занимающейся развитием GigaChat, открыта позиция ML-инженера, фокусирующегося на online reinforcement learning. Идеальный кандидат должен уметь превращать исследовательские идеи в работающие решения, включая проектирование и запуск экспериментов.
Что предстоит делать
- Проектировать и реализовывать решения для online RL
- Работать с LLM post-training и RLHF
- Запускать и анализировать эксперименты для оптимизации моделей
- Сотрудничать с другими командами для интеграции ML-решений
- Участвовать в разработке и улучшении распределенных систем обучения
Что важно знать
Роль предполагает активное участие в исследовательских проектах, где требуется не только техническая экспертиза, но и креативный подход к решению задач. Это отличная возможность для профессионалов, желающих работать с передовыми технологиями в области машинного обучения.
Подписка TalentMove
Больше,
чем вакансии
→ TalentScanAI
Узнайте стоимость вашего опыта на рынке
→ Закрытое сообщество
Нетворкинг и инсайды рынка труда
→ Топ вакансии
Лучшие вакансии с доставкой в Telegram