Назад
4 дня назад

Research Scientist (AI Alignment)

230 000 - 930 000$
Формат работы
onsite
Тип работы
fulltime
Страна
US
vacancy_detail.hirify_telegram_tooltipВакансия из Telegram канала -

Мэтч & Сопровод

Покажет вашу совместимость и напишет письмо

Описание вакансии

TL;DR
Research Scientist (AI Alignment): Исследование scalable oversight и разработка методов проверки результатов работы продвинутых ИИ-моделей с акцентом на дебаты, пересказ и другие подходы к оценке рассуждений. Focus on проведение сложных исследовательских экспериментов, применении сильной математики и решении задач в области выравнивания ИИ.
tl;dr: Research Scientist, Berkeley, $230k–930k/year

В начале сентября ИИ решил Навье — Стокса, одну из семи задач тысячелетия. Само доказательство вышло на 165 страниц, и его проверка заняла бы годы. Но математикам повезло, у них есть Lean. А как вообще людям проверять результаты работы очень умных моделей — сейчас, а тем более в будущем?

Если что, хороших ответов на этот вопрос у человечества пока нет! Но есть какие-то — например, пересказ. Если доказательство на 165 страниц нам не осилить, пусть модель перескажет его по кускам, потом перескажет пересказы — и на n-ом шаге останется текст, который человек уже сможет проверить сам. Фаундер Resolution Джеффри Ирвинг развивал другую ветку: дебаты. Две модели спорят за противоположные ответы и ищут дыры друг у друга, а человек как судья решает, чей аргумент выстоял 🏬

Область науки, которая всё это придумывает, называется scalable oversight, и ею очень прикольно заниматься — эксперименты понятные, реализовывать их технически сложно, а ответы на вопросы, которые перед вами стоят, очень нужны человечеству уже сегодня.

Scalable oversight — одна из нескольких ресёрч-адженд , и они очень активно ищут в неё исследователей. В другие ищут чуть менее активно, но всё ещё да — так что если вам ближе теоретический компьютер саенс, философия, статфизика или что-нибудь ещё, напишите нам, и мы про всё расскажем.

Опыт в сейфти будет очень полезен, но, в целом, необязателен — нужны и сильные учёные из других сфер 🤓

Примерный список того, что вам понадобится:
🟡PhD или эквивалентный ему ресерч-опыт: в ML, CS, математике, физике, статистике, философии или чем-то близком;
⚪️статьи, препринты или сопоставимый результат + опыт внятного их описания;
🔴сильная математика;
🟡вы готовы много, но внимательно использовать AI в работе;
⚪️вас правда мотивирует алайнмент и вы хотите лично в него контрибьютить.

Конкретно для scalable oversight будут плюсом: опыт с дебатами, prover-verifier играми или RLHF на фронтирном масштабе, бэкграунд в теории игр, теории сложности, mechanism design или теории принятия решений.

Работа из офиса в Беркли, с визой и переездом помогают. Платят $230k–930k в год.

Пишите Наро: 🐦

Будьте осторожны: если работодатель просит войти в их систему, используя iCloud/Google, прислать код/пароль, запустить код/ПО, не делайте этого - это мошенники. Обязательно жмите "Пожаловаться" или пишите в поддержку. Подробнее в гайде →

Текст вакансии взят без изменений

Источник -