Назад
15 часов назад

Customer Reliability Engineer (Yandex 360)

Формат работы
hybrid
Тип работы
fulltime
Грейд
senior
Страна
Russia

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

Текст:
/

Кратко

Customer Reliability Engineer (Yandex 360): Обеспечение надежной работы распределенных on-premise-инсталляций корпоративных сервисов с акцентом на диагностику Linux, сетей, баз данных и инфраструктуры заказчиков. Фокус на поиске первопричин сложных инцидентов, автоматизации эксплуатации и адаптации архитектуры продуктов к закрытым корпоративным контурам.

Локация: Москва, гибридный формат работы

Компания

Yandex 360 — экосистема корпоративных сервисов для работы команд, включая Почту, Диск, Документы, Телемост, Мессенджер и Трекер.

Что делать

  • Разбирать сложные инциденты, анализировать логи, дампы сетевого трафика, работу ядра Linux и баз данных, проводить Root Cause Analysis.
  • Помогать заказчикам разворачивать и обновлять on-premise-инсталляции в гетерогенных инфраструктурах.
  • Разрабатывать скрипты и инструменты автоматизации на Python и Bash, создавать плейбуки.
  • Отвечать за надежность систем и передавать разработчикам обратную связь по эксплуатации у заказчиков.
  • Взаимодействовать с техническими специалистами и системными администраторами крупных корпоративных клиентов.

Требования

  • От 5 лет профессионального опыта.
  • Глубокое знание Linux, включая память, процессы, дисковую подсистему и namespaces; опыт работы с strace, tcpdump, lsof и perf.
  • Знание PostgreSQL, S3-совместимых хранилищ, SQL-запросов и диагностики по логам баз данных.
  • Понимание TCP/IP, DNS, OSI, балансировки L3/L7 и диагностики сетевых проблем.
  • Уверенное владение Python и Bash, понимание Docker, Containerd и Kubernetes.
  • Готовность погружаться в проблемы клиентов и доводить их до решения, а не только закрывать тикеты.

Хорошо, если есть

  • Опыт работы SRE, DevOps-инженером или системным администратором в high-load-проектах.
  • Знание Ansible, Prometheus, Grafana и ELK-стека.
  • Понимание процессов CI/CD.

Культура и преимущества

  • Работа с крупными корпоративными заказчиками и сложными распределенными инсталляциями.
  • Возможность влиять на развитие архитектуры продуктов для on-premise-эксплуатации.
  • Задачи на стыке инфраструктуры заказчика, разработки и надежности сервисов.
  • Гибридный формат работы в московском офисе.

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →