Назад
обновлено 4 дня назад

Ведущий SRE-инженер (Москва)

Тип работы
fulltime
Грейд
lead
Страна
Russia

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

Текст:
/
TL;DR
Ведущий SRE-инженер (SQL): Обеспечение production-эксплуатации, надежности и наблюдаемости продукта с акцентом на метрики, алерты, ранбуки, дашборды и управление инцидентами. Focus on проектировании отказоустойчивых сервисов, разработке DRP, автоматизации рутинных операций и предотвращении повторных аварий.

Локация: Москва, Россия

Компания

Cloud.ru развивает облачные продукты и сервисы.

Что делать

  • Отвечать за production-эксплуатацию продукта.
  • Проектировать, разрабатывать и поддерживать метрики, алерты, ранбуки и дашборды.
  • Повышать наблюдаемость и надежность продукта.
  • Участвовать в устранении аварий, стабилизации продукта и разборе постмортемов.
  • Разрабатывать меры для предотвращения повторных инцидентов и автоматизировать рутинные операции.
  • Разрабатывать DRP и участвовать в развитии эксплуатационных процессов.

Требования

  • Экспертная работа с Linux-системами и опыт их промышленной эксплуатации.
  • Практическое понимание SLO, SLI и SLA.
  • Опыт работы с Grafana, Prometheus и виртуализацией.
  • Понимание IaC-подхода и принципов работы сетей, навыки диагностики сетевых проблем.
  • Опыт работы с системами хранения данных, включая блочные массивы и SDS.
  • Знание SQL.

Хорошо, если есть

  • Опыт промышленной эксплуатации OpenStack.
  • Практический опыт работы в SRE.
  • Опыт создания отказоустойчивых масштабируемых сервисов.
  • Навыки работы с системами управления конфигурацией.

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →