Senior SRE
Описание роли
На позиции Senior SRE вы будете отвечать за обеспечение высокой доступности, масштабируемости и отказоустойчивости ключевых web-сервисов Astrum Entertainment. Выстроите процессы мониторинга, предупредите инциденты, оперативно реагируете на сбои и минимизируете время простоя. Ваши основные задачи:
* Поддержка и администрирование инфраструктуры на bare-metal и виртуальных серверах;
* Управление кластерами Kubernetes и внедрение GitOps-подхода для автоматизированного развёртывания сервисов;
* Администрирование и оптимизация баз данных MySQL, PostgreSQL, Clickhouse и Tarantool;
* Настройка и сопровождение брокеров Kafka и RabbitMQ, обеспечение стабильного обмена сообщениями;
* Конфигурирование балансировщиков нагрузки на базе Nginx, написание Dockerfile и создание Helm-шаблонов;
* Разработка и поддержка CI/CD-пайплайнов в GitLab, автоматизация задач с помощью Ansible и SaltStack;
* Непрерывное обновление и ведение технической документации, участие в дежурствах.
Особенности вакансии
Мы предлагаем полностью удалённый формат работы с гибким графиком и регулярными дежурствами, что позволит совмещать профессиональную деятельность и личные проекты. Вы получите доступ к передовым инструментам автоматизации и мониторинга (Prometheus, Grafana), возможность проектировать отказоустойчивые решения и мигрировать сервисы в контейнеры. Работа в Astrum Entertainment даст вам шанс влиять на архитектуру высоконагруженных игровых и развлекательных сервисов, взаимодействовать с кросс-функциональными командами разработки и управления продуктом.
О компании Astrum Entertainment
Astrum Entertainment специализируется на разработке и поддержке онлайн-игр и интерактивных платформ, объединяя передовые технологии и креативные подходы к гейм-дизайну. Компания ценит инновации, открытость и ответственность: сотрудники участвуют в архитектурных решениях, масштабируют сервисы и внедряют лучшие практики SRE. В Astrum Entertainment вы получите доступ к внутренним хакатонам, техническим конференциям и программам профессионального развития. Работа в международном проекте с постоянным ростом нагрузки и новых вызовов позволит углубиться в DevOps-культуру и расширить экспертизу.
Дополнительно, вы будете принимать участие в разработке планов Disaster Recovery, оценивать риски и предлагать решения по построению отказоустойчивой многоуровневой инфраструктуры. Регулярный анализ метрик и логов позволит выявлять узкие места в производительности, а внедрение OpenTelemetry обеспечит глубокий мониторинг приложений. Мы ожидаем от вас не только технического мастерства, но и проактивного подхода к улучшению процессов и культивированию культуры SRE в компании.
Подписка TalentMove
Больше,
чем вакансии
→ TalentScanAI
Узнайте стоимость вашего опыта на рынке
→ Закрытое сообщество
Нетворкинг и инсайды рынка труда
→ Топ вакансии
Лучшие вакансии с доставкой в Telegram