Senior Infrastructure Engineer для GPU Platform

Что за роль

Senior Infrastructure Engineer (GPU Platform) отвечает за создание и поддержку инфраструктуры для многопроцессорного обучения на GPU. Важная часть работы заключается в автоматизации процессов и обеспечении наблюдаемости за системой.

Что предстоит делать

  • Настройка и поддержка многопроцессорной инфраструктуры для обучения на GPU
  • Устранение неполадок в сетевой инфраструктуре и хранилищах данных
  • Работа с Kubernetes или Slurm для управления ресурсами
  • Автоматизация процессов и мониторинг состояния системы
  • Ведение инцидентов и взаимодействие с поставщиками услуг

Что потребуется

  • Опыт работы с инфраструктурой для многопроцессорного обучения на GPU
  • Глубокие знания Linux, контейнеров, CUDA и стека NVIDIA GPU
  • Опыт диагностики проблем в рабочих нагрузках обучения, сетях и хостах GPU
  • Английский язык на уровне Upper-Intermediate или выше

Что важно знать

Роль требует высокой квалификации в области инфраструктуры и работы с GPU, а также способности к быстрому решению проблем. Опыт работы в AI-лабораториях или HPC-средах будет преимуществом.

Оценка вакансии
8 / 10
Вакансия предлагает интересные задачи в области GPU-инфраструктуры с четкими требованиями к опыту и навыкам. Описание ролей и задач довольно ясное, но отсутствуют детали о компании и условиях работы.
Опубликовано:

Будьте в курсе новых вакансий

Подпишитесь на наш Telegram-канал