ML-инженер для Online RL

Что за роль

В команде, занимающейся развитием GigaChat, открыта позиция ML-инженера, фокусирующегося на online reinforcement learning. Идеальный кандидат должен уметь превращать исследовательские идеи в работающие решения, включая проектирование и запуск экспериментов.

Что предстоит делать

  • Проектировать и реализовывать решения для online RL
  • Работать с LLM post-training и RLHF
  • Запускать и анализировать эксперименты для оптимизации моделей
  • Сотрудничать с другими командами для интеграции ML-решений
  • Участвовать в разработке и улучшении распределенных систем обучения

Что важно знать

Роль предполагает активное участие в исследовательских проектах, где требуется не только техническая экспертиза, но и креативный подход к решению задач. Это отличная возможность для профессионалов, желающих работать с передовыми технологиями в области машинного обучения.

Оценка вакансии
8 / 10
Вакансия предлагает интересные задачи в области машинного обучения с акцентом на online RL и LLM post-training. Ясно описаны обязанности, но нет информации о компании и условиях работы.
Опубликовано:

Будьте в курсе новых вакансий

Подпишитесь на наш Telegram-канал