Вакансия из Telegram канала - Название доступно после авторизации
Пожаловаться
Зарплата и рынок
ЗП не указана
На похожих ролях по рынку
$2к$2.7кмедиана$3.2к
33 в выборке
На международном рынке: $125к/год ($82к - $170к)
79
Хорошая вакансия
развернуть
Здесь можно работать с современной инфраструктурой для ИИ, но длинный список узкоспециализированных технологий и неуказанная зарплата мешают оценить нагрузку и условия.
Кликните для подробной информации
Широкий охватЗарплата не указанаСовременный стекИнфраструктура ИИ
Оценка от Hirify AI
Мэтч & Сопровод
Покажет вашу совместимость и напишет письмо
Создать профиль и узнать мэтч
Описание вакансии
TL;DR
DevOps-инженер (сопровождение облачных технологий и платформы ИИ): Обеспечение отказоустойчивости и администрирование платформы искусственного интеллекта с акцентом на Kubernetes, GPU-инфраструктуру и автоматизацию инфраструктуры как кода. Focus on анализе инцидентов, проектировании вычислительных ресурсов для AI/ML и сопровождении распределённых систем на базе Infiniband.
👩💻ВакансияDevOps-инженер (сопровождение облачных технологий и платформы ИИ)
🟢Удаленно🟢Полная занятость 🟢ЗП обсуждается на собеседовании 🟢В компанию Альфа-Банк
🟦Задачи
– Обеспечивать отказоустойчивость работы платформы искусственного интеллекта, формировать планы аварийных переключений, применять технологии для обеспечения отказоустойчивой работы
– Анализировать метрики производительности, проводить анализ причин инцидентов и ошибок работы платформы искусственного интеллекта, разрабатывать меры по недопущению повторений сбоев
– Автоматизировать рутинные действия, внедрять и применять лучшие практики подхода ""инфраструктура как код""
– Принимать участие в проектировании и организации вычислительных ресурсов для решения новых функциональных задач и внедрения в эксплуатациют технологий, в части касающейся системного программного обеспечения оркестрации микросервисов и аппаратно-технических средств используемых в средах с применением графических ускорителей платформ искусственного интеллекта
– Осуществлять администрирование системного программного обеспечения платформ искусственного интеллекта, включая операционные системы, оркестратор микросервисов, модули управления и мониторинга и другие компоненты
🟦Требования
– Опыт сопровождения Kubernetes от 3 лет
– Опыт внедрения кластеров виртуализации, частных/публичных облаков с использованием GPU Nvidia для AI/ML, в т.ч. LLM
– Опыт использования и развертывания Istio, haproxy, opensearch, vector, kafka, victoria metrics, vault, kyverno, calico, Kserve, multus, sriov, rdma, infiniband, patroni, postgresql, , multi-tenant k8s, nvidia gpu-operator, network operator, dcgm, grafana, argo workflow, argo cd
– Опыт внедрения и сопровождения систем с использованием сети Infiniband на базе коммутаторов Mellanox
– Понимание работы, тюнинг и настройка OpenSM (настройка фабрик Infiniband)
Навыки использования Go\Python (создание скриптов, операторов K8S)
– Знание и применение Ansible/Terraform
– Понимание принципов работы NFS, S3 (опыт работы приветствуется)
🌐
Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →
Текст вакансии взят без изменений
Источник - Telegram канал. Название доступно после авторизации