DevOps Engineer / Platform Engineer (ML Infrastructure)
Мэтч & Сопровод
Покажет вашу совместимость и напишет письмо
Описание вакансии
TL;DR
DevOps Engineer / Platform Engineer (ML Infrastructure): Трансформация инфраструктуры из набора поддерживаемых вручную сервисов в отказоустойчивую автоматизированную платформу с акцентом на Kubernetes, S3-совместимое хранение и строгий CI/CD в GitLab. Фокус на внедрении IAM/SSO, построении надежных HA-механизмов и автоматизации контроля качества кода и тестирования для ML-моделей.
Локация: null
Зарплата: null
Компания
В лаборатории интеллектуальных систем требуется DevOps-инженер для развития ML-инфраструктуры и платформенной автоматизации.
Что делать
- Контейнеризовать сервисы и переносить их в Kubernetes, настраивая High Availability, самовосстановление и автомасштабирование.
- Внедрить IAM через Identity Provider (IdP) и Single Sign-On (SSO) для автоматизации онбординга/офбординга пользователей.
- Спроектировать и реализовать миграцию данных сервисов на единое S3-совместимое хранилище, включая резервное копирование и отказоустойчивость данных.
- Развивать CI/CD в GitLab: обязательные проверки качества кода (lint/format, статический анализ), автобилды десктопных приложений, запуск unit-тестов для новых ML-моделей и архитектурный контроль.
- Обеспечивать стабильную работу текущего стека (GitLab, Wiki, Planka, ClearML, CVAT), включая траблшутинг и аудит процессов резервного копирования.
- Помогать во внедрении и первоначальной настройке Jira для упорядочивания рабочих процессов команды.
Требования
- Уверенные знания Kubernetes: архитектура K8s, контейнеризация сервисов, High Availability, автомасштабирование и механизмы самовосстановления.
- Глубокое понимание CI/CD: опыт построения и оптимизации пайплайнов в GitLab CI/CD, автоматизация сборки (включая десктопные приложения) и тестирования.
- Опыт автоматизации качества кода в CI/CD: линтинг и форматирование, статический анализ (Ruff, Black, Mypy, Isort).
- Практический опыт проектирования, миграции и администрирования S3-совместимых хранилищ, настройка резервного копирования и обеспечение отказоустойчивости данных.
- Опыт администрирования/поддержки ML-стека (ClearML, CVAT) и траблшутинга инфраструктуры машинного обучения — будет плюсом.
- Базовые знания Python для чтения инфраструктурных скриптов, тестов и конфигураций линтеров.
Хорошо, если есть
- Опыт в роли MLOps / ML Infrastructure и понимание жизненного цикла ML-моделей.
- Опыт внедрения IAM/безопасности: IdP и протоколы SSO.
- Опыт работы с удаленными стендами на базе одноплатных компьютеров для проверки прошивок.
Культура и преимущества
- График работы 5/2.
- Испытательный срок — 3 месяца.
- Официальное трудоустройство и «белая» заработная плата по ТК РФ, социальный пакет.
- Корпоративная программа ДМС (включая стоматологию) и обеспечение питания.
- Зарплатный проект ВТБ, Сбер; профессиональный и дружный коллектив.
Процесс найма
- Собеседования с оценкой опыта по Kubernetes, GitLab CI/CD, S3 и IAM/SSO.
- Проверка практических навыков по автоматизации качества кода и надежности инфраструктуры.
Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →