Назад
5 дней назад

Senior DevOps / MLOps (ML)

5 000 - 10 000$
Формат работы
hybrid
Тип работы
fulltime
Грейд
senior
Страна
Russia
vacancy_detail.hirify_telegram_tooltipВакансия из Telegram канала -

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

TL;DR
Senior DevOps / MLOps (ML): Проектирование и создание с нуля распределённой вычислительной платформы примерно на 1000 машин для ML-задач с акцентом на Kubernetes/Nomad, GPU-кластеры и distributed training. Focus on масштабировании, производительности, отказоустойчивости, автоматизации управления ресурсами и инфраструктуре для обучения нейросетей.
Публикатор:
Обсуждение: @devops_jobs
#вакансия #работа

VICTORY IT, Senior DevOps / MLOps, 5 000-10 000$ на руки

Екатеринбург, гибрид, полная занятость

Ищем Senior DevOps / MLOps в команду больших языковых моделей и машинного обучения в VICTORY IT. Будем строить платформу распределённых вычислений, которая объединит CPU/GPU и другие вычислительные ресурсы в единую инфраструктуру для ML-задач.

Над чем предстоит работать:
• проектировать и с нуля строить распределённую вычислительную платформу на ~1000 машин;
• развивать инфраструктуру на Kubernetes / Nomad для запуска и управления ML workload'ами;
• работать с GPU-кластерами и вычислительными ресурсами разных типов — GPU, CPU, MPS;
• развивать распределённые вычисления на Ray и инфраструктуру для distributed training;
• автоматизировать размещение и запуск задач, управление ресурсами и их загрузкой;
• заниматься масштабированием, производительностью, отказоустойчивостью, CI/CD и мониторингом;
• тесно работать с ML-командой над инфраструктурой для обучения и запуска нейросетей.

Что ожидаеv от кандидата:
• 3–5+ лет опыта в DevOps / MLOps / Platform Engineering;
• уверенный Kubernetes и/или Nomad;
• опыт работы с большими production-кластерами и распределёнными системами;
• практический опыт с GPU-инфраструктурой;
• понимание обучения нейросетей и distributed training;
• опыт с Docker / Docker Registry, CI/CD, Linux, мониторингом;
• опыт проектирования и создания инфраструктуры с нуля.
• будет большим плюсом опыт с HPC, суперкомпьютерами, GPU-фермами, Ray и крупными вычислительными кластерами.

Писать:

PS: это не классический DevOps про поддержку готовой инфраструктуры. Здесь предстоит строить распределённую платформу практически с нуля и работать с GPU/ ML на большом масштабе.

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →

Текст вакансии взят без изменений

Источник -