Назад
обновлено 4 дня назад

ML-Разработчик В Команду Гуманоидных Роботов (Robotics)

Формат работы
onsite
Тип работы
fulltime
Грейд
junior
Английский
b2
Страна
Russia

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

Текст:
/
TL;DR
ML-Разработчик (Robotics/RL): Разработка и оптимизация методов post-training и fine-tuning для VLA-моделей в команде гуманоидных роботов с акцентом на Reinforcement Learning и Imitation Learning. Фокус на повышении устойчивости моделей к OOD-состояниям, создании recovery-пайплайнов и интеграции ML-моделей в реальные физические устройства.

Локация: Офис в Москве

Компания

Yandex — международная технологическая компания, развивающая направление автономного транспорта и робототехники, от исследований до серийного производства.

Что делать

  • Разрабатывать пайплайны дообучения VLA на данных реальных роботов, симуляциях и демонстрациях для повышения success rate.
  • Исследовать и внедрять RL-подходы (offline RL, offline-to-online RL, residual RL) для улучшения политик управления.
  • Развивать методы обучения на корректирующих данных (corrective data) и траекториях восстановления с использованием подходов DAgger и Learning from Human Interventions.
  • Повышать робастность моделей в сложных и нештатных сценариях (OOD robustness) и анализировать failure modes.
  • Формировать и отслеживать метрики качества: success rate, recovery rate и intervention rate.

Требования

  • Уверенное программирование на Python и опыт работы с PyTorch.
  • Сильная база в Deep Learning и Reinforcement Learning (policy optimization, actor-critic, value learning).
  • Понимание принципов Behavior Cloning, Covariate Shift и Dataset Aggregation.
  • Умение проводить абляции, работать с метриками и анализировать причины деградации моделей.
  • Способность читать исследовательские статьи и превращать их в устойчивые ML-пайплайны.

Хорошо, если есть

  • Опыт работы с гуманоидными или иными физическими робототехническими платформами.
  • Знакомство с Human-Gated DAgger, Safe RL или Constrained RL.
  • Опыт работы с симуляторами Isaac Lab, Isaac Sim, MuJoCo или ManiSkill.

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →