Senior Infrastructure Engineer для GPU Platform
- Senior
- Полная занятость
- 3-5 лет
Что за роль
Senior Infrastructure Engineer (GPU Platform) отвечает за создание и поддержку инфраструктуры для многопроцессорного обучения на GPU. Важная часть работы заключается в автоматизации процессов и обеспечении наблюдаемости за системой.
Что предстоит делать
- Настройка и поддержка многопроцессорной инфраструктуры для обучения на GPU
- Устранение неполадок в сетевой инфраструктуре и хранилищах данных
- Работа с Kubernetes или Slurm для управления ресурсами
- Автоматизация процессов и мониторинг состояния системы
- Ведение инцидентов и взаимодействие с поставщиками услуг
Что потребуется
- Опыт работы с инфраструктурой для многопроцессорного обучения на GPU
- Глубокие знания Linux, контейнеров, CUDA и стека NVIDIA GPU
- Опыт диагностики проблем в рабочих нагрузках обучения, сетях и хостах GPU
- Английский язык на уровне Upper-Intermediate или выше
Что важно знать
Роль требует высокой квалификации в области инфраструктуры и работы с GPU, а также способности к быстрому решению проблем. Опыт работы в AI-лабораториях или HPC-средах будет преимуществом.
Подписка TalentMove
Больше,
чем вакансии
→ TalentScanAI
Узнайте стоимость вашего опыта на рынке
→ Закрытое сообщество
Нетворкинг и инсайды рынка труда
→ Топ вакансии
Лучшие вакансии с доставкой в Telegram