Мэтч & Сопровод
Покажет вашу совместимость и напишет письмо
Описание вакансии
Кратко
Customer Reliability Engineer (Yandex 360): Обеспечение надежной работы распределенных on-premise-инсталляций корпоративных сервисов с акцентом на диагностику Linux, сетей, баз данных и инфраструктуры заказчиков. Фокус на поиске первопричин сложных инцидентов, автоматизации эксплуатации и адаптации архитектуры продуктов к закрытым корпоративным контурам.
Локация: Москва, гибридный формат работы
Компания
Yandex 360 — экосистема корпоративных сервисов для работы команд, включая Почту, Диск, Документы, Телемост, Мессенджер и Трекер.
Что делать
- Разбирать сложные инциденты, анализировать логи, дампы сетевого трафика, работу ядра Linux и баз данных, проводить Root Cause Analysis.
- Помогать заказчикам разворачивать и обновлять on-premise-инсталляции в гетерогенных инфраструктурах.
- Разрабатывать скрипты и инструменты автоматизации на Python и Bash, создавать плейбуки.
- Отвечать за надежность систем и передавать разработчикам обратную связь по эксплуатации у заказчиков.
- Взаимодействовать с техническими специалистами и системными администраторами крупных корпоративных клиентов.
Требования
- От 5 лет профессионального опыта.
- Глубокое знание Linux, включая память, процессы, дисковую подсистему и namespaces; опыт работы с strace, tcpdump, lsof и perf.
- Знание PostgreSQL, S3-совместимых хранилищ, SQL-запросов и диагностики по логам баз данных.
- Понимание TCP/IP, DNS, OSI, балансировки L3/L7 и диагностики сетевых проблем.
- Уверенное владение Python и Bash, понимание Docker, Containerd и Kubernetes.
- Готовность погружаться в проблемы клиентов и доводить их до решения, а не только закрывать тикеты.
Хорошо, если есть
- Опыт работы SRE, DevOps-инженером или системным администратором в high-load-проектах.
- Знание Ansible, Prometheus, Grafana и ELK-стека.
- Понимание процессов CI/CD.
Культура и преимущества
- Работа с крупными корпоративными заказчиками и сложными распределенными инсталляциями.
- Возможность влиять на развитие архитектуры продуктов для on-premise-эксплуатации.
- Задачи на стыке инфраструктуры заказчика, разработки и надежности сервисов.
- Гибридный формат работы в московском офисе.
Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →