Назад
9 часов назад

Senior Site Reliability Engineer

Формат работы
remote (Global)
Тип работы
fulltime
Грейд
senior
vacancy_detail.hirify_telegram_tooltipВакансия из Telegram канала -

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

TL;DR
Senior Site Reliability Engineer (DevOps/инфраструктура): Проектирование и внедрение многорегиональной отказоустойчивой инфраструктуры для миллионов одновременных сессий с акцентом на гибридную миграцию между bare-metal дата-центрами и облаком, мониторинг и автоматизацию. with an accent on высокую доступность, on-call и incident response. Focus on построение IaC и CI/CD пайплайнов, проактивное обнаружение проблем и поддержание SLA.
Senior Site Reliability Engineer

🏢 Компания:
🌍 Формат: Удалёнка — в любой стране
🕒 Занятость: Полная занятость

О компании:

— одна из крупнейших игровых платформ в мире и номер 1 для игры, обучения и контента по шахматам. Команда 600+ полностью удалённых сотрудников в 60+ странах. Поддерживают аудиторию 250M+ игроков, фокусируясь на продукте, контенте и инструментах для сообщества.

Задачи:

• Проектировать и внедрять многорегиональную отказоустойчивую инфраструктуру для миллионов одновременных сессий.
• Вести стратегию гибридной миграции между bare-metal дата‑центрами и облаком.
• Отвечать за on-call и процедуры инцидент‑реагирования для поддержания SLA.
• Архитектурно выстраивать системы мониторинга и алертинга для проактивного обнаружения проблем.
• Внедрять инфраструктуру как код и CI/CD пайплайны совместно с командами разработки.
• Автоматизировать операционные процессы и наставлять коллег по SRE‑практикам.

Требования:

• 5+ лет опыта в SRE, DevOps или инфраструктурной инженерии.
• Уверенные навыки работы с UNIX/Linux и администрированием командной строки.
• Опыт управления bare‑metal инфраструктурой и операциями дата‑центров.
• Опыт работы с облачными платформами (GCP, AWS или Azure) и IaC (Terraform, CloudFormation и т.п.).
• Контейнеризация и оркестрация (Docker, Kubernetes и т.п.).
• Знание систем мониторинга и наблюдаемости (Datadog, Prometheus, Grafana, ELK и т.п.).

Будет плюсом:

• Знание CDN и edge‑решений.
• Скриптинг и автоматизация (Python, Go, Bash).
• Опыт HA‑архитектур и планирования восстановления после сбоев.
• Знакомство с требованиями безопасности и комплаенсом.
• Опыт с игровыми серверами или хостингом реального времени.
• Опыт планирования ёмкости и тестирования производительности.

Стек:

GCP, AWS, Azure, Terraform, CloudFormation, Ansible, Chef, Puppet, Docker, Kubernetes, Datadog, Prometheus, Grafana, ELK, relational databases, NoSQL, Python, Go, Bash

Условия:

• Полная занятость
• 100% удалённо (работа из любой точки мира)

📩

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →

Текст вакансии взят без изменений

Источник -