TGViewer
Сиолошная Сиолошная @seeallochnaya · 80.4K subscribers
Post #747 17.4K
😄 в OpenAI появилась новая команда — Preparedness Team, или "Команда Готовности" по-русски.

Команда создана для оценки, прогнозирования и защиты от рисков, связанных с развитым искусственным интеллектом — от современных моделей до AGI. В частности, затрагиваются следующие направления работ:
— индивидуальное убеждение (когда одна модель может смещать точку зрения сотен миллионов пользователей. Такое ни одному политику и не снилось! Но как можно контролировать отсутствие подобных проблем?)
— кибербезопасность
— химические, биологические и ядерные угрозы
— автономная репликация и адаптация (ARA, про это писал раньше вот тут)

Управление катастрофическими рисками, исходящими от передового ИИ, потребует ответов на такие вопросы, как:
— Насколько опасны передовые ИИ-системы (в настоящее время и в будущем), если их неправильно использовать?
— Как мы можем создать надежную систему для мониторинга, оценки, прогнозирования и защиты от опасных возможностей передовых систем?
— Если бы передовые модели были украдены, как злоумышленники могли бы ими воспользоваться?

Исходя из ответов на эти и сотни других вопросов, будет дорабатываться стратегия, понимание, инфраструктура, необходимые для обеспечения безопасности систем.

Команду возглавит Aleksander Madry, профессор MIT, весной взявший паузу для того, чтобы присоединиться к OpenAI. Сейчас открыто 2 вакансии с окладом до $370k в год.

Также OpenAI запускают Preparedness Challenge, где вы можете поделиться своими идеями касательно тем выше, чтобы получить один из десяти призов в виде $25k API-кредитов на дальнейшую работу, а также шанс получить оффер. В решении нужно описать в деталях (но не более 3 страниц A4), как можно использовать украденные модели. А ещё предложить тезисный план экспериментов и рекомендуемые действия для борьбы с подобного рода угрозами. В общем, ждём господ с LessWrong с отправкой десятков идей по уничтожению мира 🤯
  • 👍 79
  • ❤ 12
  • 🤮 12
  • 😁 6
  • 🤔 4
  • 🤡 3
  • 🆒 1
More from @seeallochnaya
  1. Oct 10, 2026И моё мнение про то, что написал Terence Tao (или вернее как я понял, что он написал). В к…
  2. Oct 10, 2026Kevin заканчивает своё эссе так: Мой личный ответ на вопрос о том, в чём заключается суть…
  3. Oct 10, 2026Возвращаясь к математике, я прочитал разные мнение, и одним из самых откликнувшихся оказал…
  4. Oct 10, 2026Пока делаю паузу в написании постов на пару часов (по этой теме будет ещё 2-3-4), поделюсь…
  5. Oct 10, 2026Сам Terence этот пост не прокомментировал, так что можно спекулировать, согласен ли он с э…
  6. Oct 10, 2026Многие сейчас ополчились на OpenAI и считают, что они не должны были выкладывать решения.…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →