TGViewer
Take Friends to Luna Park Take Friends to Luna Park @hrlunapark · 20.3K subscribers
Post #404 7K
tl;dr: Research Scientist, Berkeley, $230k–930k/year

В начале сентября ИИ решил Навье — Стокса, одну из семи задач тысячелетия. Само доказательство вышло на 165 страниц, и его проверка заняла бы годы. Но математикам повезло, у них есть Lean. А как вообще людям проверять результаты работы очень умных моделей — сейчас, а тем более в будущем?

Если что, хороших ответов на этот вопрос у человечества пока нет! Но есть какие-то — например, пересказ. Если доказательство на 165 страниц нам не осилить, пусть модель перескажет его по кускам, потом перескажет пересказы — и на n-ом шаге останется текст, который человек уже сможет проверить сам. Фаундер Resolution Джеффри Ирвинг развивал другую ветку: дебаты. Две модели спорят за противоположные ответы и ищут дыры друг у друга, а человек как судья решает, чей аргумент выстоял 🏬

Область науки, которая всё это придумывает, называется scalable oversight, и ею очень прикольно заниматься — эксперименты понятные, реализовывать их технически сложно, а ответы на вопросы, которые перед вами стоят, очень нужны человечеству уже сегодня.

Scalable oversight — одна из нескольких ресёрч-адженд Resolution, и они очень активно ищут в неё исследователей. В другие ищут чуть менее активно, но всё ещё да — так что если вам ближе теоретический компьютер саенс, философия, статфизика или что-нибудь ещё, напишите нам, и мы про всё расскажем.

Опыт в сейфти будет очень полезен, но, в целом, необязателен — нужны и сильные учёные из других сфер 🤓

Примерный список того, что вам понадобится:
🟡PhD или эквивалентный ему ресерч-опыт: в ML, CS, математике, физике, статистике, философии или чем-то близком;
⚪️статьи, препринты или сопоставимый результат + опыт внятного их описания;
🔴сильная математика;
🟡вы готовы много, но внимательно использовать AI в работе;
⚪️вас правда мотивирует алайнмент и вы хотите лично в него контрибьютить.

Конкретно для scalable oversight будут плюсом: опыт с дебатами, prover-verifier играми или RLHF на фронтирном масштабе, бэкграунд в теории игр, теории сложности, mechanism design или теории принятия решений.

Работа из офиса в Беркли, с визой и переездом помогают. Платят $230k–930k в год.

Пишите Наро: @a_nro 🐦
  • ❤ 64
  • 😱 34
  • ❤‍🔥 11
  • 🔥 8
  • 👍 5
  • 😁 4
More from @hrlunapark
  1. Sep 3, 2026tl;dr: software engineer (early hire), $120k-240k+, remote worldwide Когда-то мы мечтали з…
  2. Aug 31, 2026tl;dr: senior backend engineers, $135k-270k/year + equity, London / SF Любимые Apollo Rese…
  3. Aug 20, 2026tl;dr: Research Engineers, Berkeley, $230k-930k/year Какие новости в AI Safety? Например,…
  4. Aug 6, 2026tl;dr: Research Manager, short-term (long-term possible), $6k-9k/month, Capetown, South Af…
  5. Aug 3, 2026Post #399
  6. Jul 16, 2026tl;dr: mobile / full-stack engineers, TypeScript + React + Python, $125k-225k + equity, Lo…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →