Назад
5 дней назад

SRE-инженер (система мониторинга)

318 300
Формат работы
hybrid/onsite
Тип работы
fulltime
Грейд
middle
Страна
Russia
hhВакансия с HeadHunter. Контакт ведёт на hh.ru

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

Текст:
/
TL;DR
SRE-инженер (система мониторинга) (Prometheus/VictoriaMetrics/Grafana): Развитие системы мониторинга и алертинга для более чем 110 ИТ-услуг с акцентом на наблюдаемость, масштабируемость и управляемость критичного ИТ-ландшафта. Focus on проектировании единого мониторинга, настройке Prometheus, VictoriaMetrics, Grafana и OpenSearch, а также построении потоков обработки данных через Kafka и Data Prepper.

Локация: Санкт-Петербург; работа на месте работодателя, в условиях также указан гибридный формат

Зарплата: до 318 300 рублей в месяц до вычета налогов

Компания

СБЕР развивает системы рисков корпоративно-инвестиционного бизнеса и критичный ИТ-ландшафт, включающий более 110 ИТ-услуг.

Что делать

  • Развивать систему мониторинга и алертинга для критичных ИТ-сервисов.
  • Проектировать подходы и внедрять решения для повышения наблюдаемости сервисов.
  • Настраивать и сопровождать Prometheus, Alertmanager, VictoriaMetrics и Grafana.
  • Развивать сбор, обработку и хранение логов и метрик с использованием OpenSearch, Data Prepper, Vector, FluentBit и Kafka.
  • Создавать и поддерживать масштабируемый единый контур мониторинга.

Требования

  • От 1 года до 3 лет опыта работы в SRE или смежной области.
  • Опыт работы с Unix-based системами, контейнеризацией и Kubernetes на уровне пользователя.
  • Уверенные знания Prometheus exporters, Prometheus, Alertmanager, VictoriaMetrics, Grafana и OpenSearch.
  • Навыки IaC с Ansible и Helm, написания плейбуков и чартов.
  • Знание PromQL, KQL, DQL, систем сбора логов и метрик, а также инструментов построения pipeline обработки данных.
  • Понимание кластеризации, настройки хранилищ, индексов, шардирования, репликации и оптимизации производительности.

Хорошо, если есть

  • Опыт работы с Jenkins, CI/CD и Groovy.
  • Навыки автоматизации на Bash или Python.
  • Опыт работы с Telegraf.
  • Знания prompt engineering, LLM и AI-агентов.

Культура и преимущества

  • Официальное оформление с первого дня, стабильный оклад, годовое премирование и социальная поддержка.
  • Расширенный ДМС для сотрудников и льготная медицинская страховка для близких.
  • Корпоративное обучение, участие в профессиональных конференциях и доступ к образовательным программам.
  • Работа по Agile в среде продуктовых ИТ-команд и возможность внутреннего перемещения.
  • Корпоративная пенсионная программа, спортивные льготы и современное рабочее оборудование.
  • Свободный dress code и возможность самостоятельно выбирать технологии и предлагать решения.

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →