Назад
9 часов назад

DevOps / SRE-инженер (Kubernetes, Highload)

100 000 - 150 000
Формат работы
remote (только Russia)
Тип работы
fulltime
Грейд
junior
Страна
Russia
hhВакансия с HeadHunter. Контакт ведёт на hh.ru

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

Текст:
/
TL;DR
DevOps / SRE-инженер (Kubernetes, Highload): Поддержка и развитие Kubernetes-инфраструктуры на bare-metal для высоконагруженных сервисов с акцентом на наблюдаемость, отказоустойчивость и производительность. Фокус на автоматизации CI/CD, диагностике инцидентов, оптимизации инфраструктуры и обеспечении безопасной эксплуатации.

Локация: удалённая работа; вакансия указана для Иннополиса, Россия

Зарплата: 100 000–150 000 ₽ в месяц на руки

Компания

Развитие IT-платформ для автоматизации операционных процессов в производственной индустрии, HoReCa и бухгалтерии, а также проектов по распознаванию и обработке документов с применением ML и AI.

Что делать

  • Поддерживать и развивать Kubernetes-кластер на bare-metal-инфраструктуре.
  • Обеспечивать стабильность, отказоустойчивость, производительность и масштабирование высоконагруженных сервисов.
  • Развивать observability-стек на базе Grafana, OpenTelemetry, Victoria Metrics, централизованного логирования, метрик и алертинга.
  • Администрировать Keycloak, включая аутентификацию, авторизацию и управление доступами.
  • Настраивать CI/CD, автоматизировать развёртывание и обновления, совместно с разработчиками улучшать релизный процесс.
  • Анализировать инциденты, устранять узкие места, заниматься безопасностью, резервным копированием, восстановлением и документацией инфраструктуры.

Требования

  • Коммерческий опыт работы DevOps / SRE-инженером от 2–3 лет.
  • Уверенное знание Linux и практический опыт эксплуатации Kubernetes в production.
  • Опыт работы с Docker и контейнерной инфраструктурой.
  • Знание мониторинга, метрик, логирования и алертинга: Grafana, Prometheus-совместимые решения, OpenTelemetry, Vector или аналоги.
  • Опыт с Keycloak либо понимание OAuth 2.0, OpenID Connect, SSO и управления доступом.
  • Навыки автоматизации на Bash, Python или Go, опыт с CI/CD, сетями, TLS, DNS, reverse proxy и firewall.

Хорошо, если есть

  • Опыт работы с Terraform, Ansible, Helm, Argo CD или Flux CD.
  • Знание PostgreSQL, Redis, Kafka, RabbitMQ и других инфраструктурных компонентов.
  • Опыт построения отказоустойчивых систем, резервного копирования и disaster recovery.
  • Практика оптимизации Kubernetes и Linux, эксплуатации self-hosted и bare-metal-инфраструктуры.

Культура и преимущества

  • Полностью удалённый формат работы.
  • Официальное оформление.
  • Небольшая команда без лишней бюрократии.
  • Возможность влиять на архитектурные решения, инструменты и процессы эксплуатации.

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →