Назад
3 дня назад

DevOps/SRE-инженер (AI)

150 000₽
Формат работы
remote (Global)
Тип работы
project
Грейд
senior
Страна
Russia
hhВакансия с HeadHunter. Контакт ведёт на hh.ru

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

Текст:
/
TL;DR
DevOps/SRE-инженер (AI): Построение и эксплуатация инфраструктуры платформы ИИ-агентов с акцентом на аудит сервисов, безопасные релизы и отказоустойчивость. Focus on настройку CI/CD, репликации PostgreSQL, мониторинга, управления секретами и восстановления систем после сбоев.

Локация: удалённая работа из любой точки мира

Зарплата: от 150 000 RUR в месяц до вычета налогов

Компания

Овелфиш создаёт платформу для бизнеса, на которой разрабатываются, обучаются и эксплуатируются ИИ-агенты для клиентского общения, продаж и контроля.

Что делать

  • Провести аудит инфраструктуры: сервисов, хостов, зависимостей, секретов и единых точек отказа.
  • Выстроить процесс релизов с версионированием, неизменяемыми Docker-образами, проверкой артефактов, выкладкой и откатом.
  • Настроить безопасность: управление и ротацию секретов, разграничение доступов, firewall, сканирование уязвимостей и подпись образов.
  • Создать отказоустойчивую схему с репликацией PostgreSQL, PITR, резервированием приложения, балансировкой, очередями и кешем.
  • Настроить мониторинг и алертинг с Prometheus, Grafana и Alertmanager, включая контроль бэкапов, репликации и дискового пространства.
  • Документировать решения в runbook-ах и взаимодействовать с разработчиками и заказчиком.

Требования

  • От 5 лет опыта в DevOps, SRE или инфраструктуре, включая работу с продакшен-системами и реальными пользователями.
  • Опыт с Docker и Docker Compose в мультисервисных конфигурациях, несколькими хостами и окружениями.
  • Практический опыт эксплуатации PostgreSQL: бэкапы, восстановление, потоковая репликация, WAL-архивация и PITR.
  • Знание Redis, RabbitMQ, CI/CD, OCI-реестров, управления секретами, Linux-hardening, firewall и least privilege.
  • Опыт с Prometheus, Grafana, Alertmanager, разбором инцидентов, post-mortem, Bash и чтением чужого кода и конфигураций.

Хорошо, если есть

  • Python, Ansible, Terraform или OpenTofu.
  • Kubernetes и GitOps с Argo CD или Flux.
  • Опыт с телефонией, нагрузочным тестированием и миграцией на отказоустойчивую архитектуру.
  • Понимание GDPR, персональных данных и AI/LLM-стека.
  • IT-образование или профильные сертификаты.

Культура и преимущества

  • Удалённая работа из любой точки мира.
  • Проектный контракт на 3–6 месяцев с возможностью продления.
  • Частичная занятость и испытательный срок 2 месяца.
  • Небольшая команда, прямая коммуникация без бюрократии.
  • Возможность влиять на архитектуру, выбирать инструменты и выстраивать инфраструктуру с нуля.

Процесс найма

  • В сопроводительном письме нужно описать релевантный опыт и указать фразу «хочу в команду».

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →