Назад
3 дня назад

ML-разработчик в группу рассуждений Alice AI

Тип работы
fulltime
Страна
Russia/Belarus
vacancy_detail.hirify_telegram_tooltipВакансия из Telegram канала -

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

TL;DR
ML-разработчик в группу рассуждений Alice AI (LLM/RL): развитие рассуждающей модели Alice AI с акцентом на генерацию сред для RL, стабилизацию обучения и анализ ошибок на сложных фактовых запросах. Фокус на проведении R&D-экспериментов по элайнменту, построении бенчмарков и поиске масштабируемых подходов к обучению языковых моделей.
🔎 ML-разработчик в группу рассуждений Alice AI

Наша команда развивает продвинутые способности Alice AI LLM, обучая наши модели решать самые нетривиальные задачи. Наша ключевая цель — сделать Алису экспертным ассистентом, способным справляться с самыми сложными запросами пользователей.

Какие задачи вас ждут:


• Развитие рассуждающей модели
Ваша главная задача — учить одну из самых сильных рассуждающих моделей. Возможные задачи: сбор и поддержка пайплайнов генерации сред для RL для новых способностей Алисы; стабилизация RL-обучения нашей рассуждающей модели; разбор ситуаций, где, как и почему модель ошибается на тяжёлых фактовых запросах.

• Обучение моделей и анализ экспериментов
Предстоит работать в RnD-цикле экспериментов над элайнментом рассуждающих моделей. Нужно будет взаимодействовать с аналитиками для построения стабильных замеров и искать точки роста инфраструктуры.

• Поиск новых направлений
В нашей работе важно уметь выделять хорошо масштабирующиеся подходы, которые помогут достичь наших целей. Вы будете экспериментировать с самыми перспективными и свежими идеями.

Мы ждём, что вы:

• Уверенно программируете на Python и внедряли в продакшен исследовательские пайплайны
• Хорошо разбираетесь в LLM и имеете опыт работы в NLP/DL
• Умеете формулировать гипотезы и выстраивать эксперименты для их проверки
• Готовы работать с неопределённостью и выбирать самое важное направление

Будет плюсом, если вы:

• Занимались файн-тюнингом или RL больших языковых моделей
• Работали в среде, требующей глубокого ресёрча (например, в AI или quantitative research)
• Собирали сложные бенчмарки для языковых моделей
• Публиковали статьи на тему языковых моделей и/или RL

Почему у нас классно:

Сотрудники Яндекса бесплатно участвуют в профильных конференциях. А для тех, кто на них выступает, у нас есть школа подготовки спикеров. Это не все бонусы — .

📩 на нашем сайте

#alice #ML #AI #RL #LLM #python #NLP

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →

Текст вакансии взят без изменений

Источник -