TGViewer
Гостев из будущего Гостев из будущего @gostev_future · 1.41K subscribers
Post #508 400
Кажется, термин «безопасность ИИ» окончательно потерял какой-либо определённый смысл.

Сначала бывший исследователь Anthropic Джейкоб Коксон заявил, что люди, создающие ИИ, всерьёз допускают сценарий, в котором он может уничтожить человечество уже к концу десятилетия.

Потом Билл Гейтс немного снизил планку: не всё человечество, а, например, миллиард погибших. Правда, у него сценарий другой — опасные люди получают в руки слишком мощный инструмент.

В это же время Anthropic пытается ограничить Claude: например, не разрешает использовать его для полностью автономного выбора и поражения людей.

Пентагон требует другого подхода: если военные законно приказали системе выполнить задачу, она должна её выполнить.

Их аргумент простой — нельзя строить критическую военную инфраструктуру вокруг ИИ, который в середине операции вдруг откажется работать из-за правил, установленных частной компанией. Именно поэтому Пентагон объявил Anthropic риском для цепочки поставок и угрозой нацбезопасности, а апелляционный суд в сентябре признал, что такая логика юридически допустима.

И почти одновременно Россия и США в Женеве добиваются удаления из проекта ООН по автономному оружию требований, чтобы такие системы были «предсказуемыми» и «надёжными», чтобы человек проверял выбранную алгоритмом цель перед атакой и чтобы при применении учитывались этические соображения.

Получается полная каша.

Одни считают главной опасностью ИИ, который перестанет слушаться человека. Другие — ИИ, который слишком хорошо послушается плохого человека. Anthropic пытается научить ИИ иногда человеку отказывать. Пентагон считает саму возможность такого отказа риском. А крупнейшие военные державы одновременно не хотят закреплять обязательный человеческий контроль перед ударом.

Похоже, они пока не договорились даже о базовом: что считать безопасным ИИ — тот, который всегда подчиняется человеку, или тот, который умеет ему отказать?

@gostev_future
  • ❤ 5
  • 👍 2
  • 👏 2
  • 🤬 1
More from @gostev_future
  1. Sep 28, 2026Наверное, вы уже слышали про новую ИИшку – Jev. Сами авторы (компания TypeSafe) называют э…
  2. Sep 25, 2026Если посмотреть на маркетплейсы, можно решить, что мы наконец дожили до момента, когда мож…
  3. Sep 24, 2026Сегодня «Коммерсантъ» со ссылкой на экспертно-аналитический центр InfoWatch сообщил нескол…
  4. Sep 24, 2026Вчера Гайка Митич и Бойка Двачич снимали сюжет «Очумелые ручки» «Школьники и роботы». Гума…
  5. Sep 23, 2026На прошлой неделе обнаружилась биолаборатория Anthropic, на этой неделе у лаборатории уже…
  6. Sep 22, 2026Помните исследование о том, как ИИ играет в Civilization? А вот мой однофамилец Питер Гост…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →