Вакансия из Telegram канала - Название доступно после авторизации
Пожаловаться
Зарплата и рынок
ЗП не указана
На похожих ролях по рынку
$2.3к$2.6кмедиана$3.3к
50 в выборке
На международном рынке: $110к/год ($61к - $135к)
86
Хорошая вакансия
развернуть
Роль чётко связана с планированием GPU-ресурсов и даёт возможность работать над облачной и AI-инфраструктурой, но без указания зарплаты сложно оценить условия по оплате.
Кликните для подробной информации
Зарплата не указанаСовременные технологииЧёткие задачиAI-инфраструктура
Оценка от Hirify AI
Мэтч & Сопровод
Покажет вашу совместимость и напишет письмо
Создать профиль и узнать мэтч
Описание вакансии
TL;DR
Системный аналитик (GPU-планирование): Анализ и развитие платформы планирования GPU-ресурсов с акцентом на требования, очереди, приоритеты, гарантии ресурсов и совместное использование вычислительной ёмкости. Фокус на сравнении Kubernetes-, batch- и GPU-планировщиков, моделировании алгоритмов, анализе метрик и сопровождении запуска решений в production.
Вакансия Системный аналитик (MLS Jobs)
🟢Удаленно🟢Полная занятость 🟢ЗП обсуждается на собеседовании 🟢В компанию Cloudru
🟦Задачи
– Анализировать загрузку GPU-кластера: находить причины простоя ресурсов, фрагментации нод, длительного ожидания задач и частых вытеснений нагрузки;
– Собирать и формализовывать требования пользователей к аллокациям, очередям, приоритетам, гарантиям ресурсов и размещению задач;
– Проектировать сценарии совместного использования ресурсов: закреплённые и эластичные аллокации, shared-нагрузка, заимствование свободной ёмкости и возврат ресурсов владельцу;
– Исследовать и сравнивать подходы Kubernetes-, batch- и GPU-планировщиков, включая Volcano, Kueue, NVIDIA KAI Scheduler и Slurm;
– Определять метрики эффективности планирования: утилизация, время ожидания, количество вытеснений, потерянные вычисления, доля заимствованных ресурсов и успешность запуска gang jobs;
– Проверять предлагаемые алгоритмы на исторических данных, моделировать граничные сценарии и оценивать влияние изменений до запуска в production;
– Готовить функциональные и нефункциональные требования, схемы процессов, RFC и постановки для команды разработки;
– Сопровождать реализацию на всех этапах: от проработки решения и тестирования до поэтапного запуска и анализа результатов;
– Работать с обратной связью пользователей, разбирать спорные сценарии распределения ресурсов и превращать их в прозрачные правила работы платформы.
🟦Требования
– Опыт работы системным или продуктовым аналитиком в инфраструктурных, облачных либо платформенных командах;
– Обладаете системным мышлением и умеете формализовывать сложные процессы с большим количеством ограничений и участников;
– Понимаете основные принципы работы Kubernetes: nodes, pods, requests и limits, affinity, taints, priorities, queues и preemption;
– Понимаете принципы планирования ресурсов: квоты, приоритеты, fairness, gang scheduling, bin packing и resource borrowing;
– Умеете отделять физическое размещение нагрузки от её логического владельца, гарантированной квоты и временно заимствованных ресурсов;
– Имеете опыт анализа метрик, событий и логов распределённых систем;
– Умеете работать с SQL и одним из инструментов анализа данных, например Python;
– Знакомы с Prometheus, Grafana и PromQL либо аналогичными инструментами мониторинга;
– Умеете готовить техническую документацию и переводить пользовательские проблемы в требования, метрики и проверяемые гипотезы;
– Способны аргументированно защищать предложения и эффективно взаимодействовать с разработчиками, архитекторами, владельцами платформы и пользовательскими командами;
– Владеете английским языком на уровне чтения технической документации.
🌐 Показать контакты
Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →
Текст вакансии взят без изменений
Источник - Telegram канал. Название доступно после авторизации