Назад
5 дней назад

SRE-инженер

270 000
Формат работы
remote (только Russia)
Тип работы
fulltime
Грейд
senior
Страна
Russia
hhВакансия с HeadHunter. Контакт ведёт на hh.ru

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

Текст:
/
TL;DR
SRE-инженер (SRE/DevOps): Диагностика инцидентов в Kubernetes-кластерах, деплоях, Kafka, PostgreSQL и Redis с акцентом на построение SRE-функции с нуля, внедрение SLO/SLI/SLA и организацию on-call. Focus on разработку регламентов реагирования, проведение постмортемов, ведение базы знаний и формирование нового SRE-отдела.

Локация: удалённая работа, редкие встречи в Москве; местонахождение в Москве очень желательно.

Зарплата: от 270 000 RUB на руки в месяц; итоговая сумма обсуждается по опыту.

Компания

Playerok — маркетплейс цифровых товаров и услуг на стыке гейминга, финтеха и электронной коммерции.

Что делать

  • Триажить алерты, обращения, ошибки Sentry и инциденты, отделять шум от реальных проблем и маршрутизировать обращения владельцам.
  • Диагностировать падения подов, деплоев, миграций, Kafka-очередей, кластеров, PostgreSQL и Redis.
  • Контролировать ёмкость дисков, lag и сертификаты, а также взаимодействовать с провайдерами.
  • Проводить разборы инцидентов, фиксировать факты, классифицировать проблемы и управлять эскалациями.
  • Закладывать SRE-процессы с нуля: измерять baseline, внедрять SLO/SLI/SLA, разрабатывать регламенты реагирования и проводить постмортемы.
  • Создать базу знаний, статус-страницы и систему on-call, а также участвовать в найме и адаптации инженеров.

Требования

  • Опыт эксплуатации от 4 лет; общий требуемый опыт — от 3 до 6 лет.
  • Опыт диагностики Kubernetes, деплоев, миграций, Kafka, PostgreSQL, Redis, логов и Sentry.
  • Готовность стать первым специалистом нового SRE-отдела и выстроить его процессы с нуля.
  • Готовность работать 5/2 по 8 часов в день.

Хорошо, если есть

  • Опыт построения SLO/SLA с нуля.
  • Опыт работы со статус-страницами и публичной коммуникацией инцидентов.
  • Знание нагрузочного тестирования.
  • Опыт взаимодействия с внешними подрядчиками по эксплуатации.
  • Terraform или Ansible на уровне чтения.

Культура и преимущества

  • Удалённый формат сотрудничества с редкими встречами в Москве.
  • Возможность выбрать форму сотрудничества и оплаты; налоги берёт на себя компания.
  • Онбординг и постепенное подключение к команде.
  • Оплачиваемые отпуск и больничный.
  • Работа с инициативными и профессиональными коллегами.

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →