Вакансия из Telegram канала - Название доступно после авторизации
Пожаловаться
Зарплата и рынок
Выше рынка
$5к-10к/мес
$4.5к$5кмедиана$5.3к
По похожим ролям (7) ~ $5к/мес
На международном рынке: $203к/год ($167к - $243к)
85
Хорошая вакансия
развернуть
Роль четко определена с ясным акцентом на создание распределенной вычислительной платформы, а зарплата выше среднего по рынку, что делает эту вакансию привлекательной.
Кликните для подробной информации
Зарплата выше рынкаЧеткие обязанностиПродуктовая компания
Оценка от Hirify AI
Мэтч & Сопровод
Покажет вашу совместимость и напишет письмо
Создать профиль и узнать мэтч
Описание вакансии
TL;DR
Senior DevOps / MLOps (ML): Проектирование и создание с нуля распределённой вычислительной платформы примерно на 1000 машин для ML-задач с акцентом на Kubernetes/Nomad, GPU-кластеры и distributed training. Focus on масштабировании, производительности, отказоустойчивости, автоматизации управления ресурсами и инфраструктуре для обучения нейросетей.
VICTORY IT, Senior DevOps / MLOps, 5 000-10 000$ на руки
Екатеринбург, гибрид, полная занятость
Ищем Senior DevOps / MLOps в команду больших языковых моделей и машинного обучения в VICTORY IT. Будем строить платформу распределённых вычислений, которая объединит CPU/GPU и другие вычислительные ресурсы в единую инфраструктуру для ML-задач.
Над чем предстоит работать:
• проектировать и с нуля строить распределённую вычислительную платформу на ~1000 машин;
• развивать инфраструктуру на Kubernetes / Nomad для запуска и управления ML workload'ами;
• работать с GPU-кластерами и вычислительными ресурсами разных типов — GPU, CPU, MPS;
• развивать распределённые вычисления на Ray и инфраструктуру для distributed training;
• автоматизировать размещение и запуск задач, управление ресурсами и их загрузкой;
• заниматься масштабированием, производительностью, отказоустойчивостью, CI/CD и мониторингом;
• тесно работать с ML-командой над инфраструктурой для обучения и запуска нейросетей.
Что ожидаеv от кандидата:
• 3–5+ лет опыта в DevOps / MLOps / Platform Engineering;
• уверенный Kubernetes и/или Nomad;
• опыт работы с большими production-кластерами и распределёнными системами;
• практический опыт с GPU-инфраструктурой;
• понимание обучения нейросетей и distributed training;
• опыт с Docker / Docker Registry, CI/CD, Linux, мониторингом;
• опыт проектирования и создания инфраструктуры с нуля.
• будет большим плюсом опыт с HPC, суперкомпьютерами, GPU-фермами, Ray и крупными вычислительными кластерами.
Писать: Показать контакты
PS: это не классический DevOps про поддержку готовой инфраструктуры. Здесь предстоит строить распределённую платформу практически с нуля и работать с GPU/ ML на большом масштабе.
Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →
Текст вакансии взят без изменений
Источник - Telegram канал. Название доступно после авторизации