TGViewer
❝[Консенсус Тьюринга]❞ ❝[Консенсус Тьюринга]❞ @turing_consensus · 704 subscribers
Post #948 83
📰 «Рубильник» для ИИ и при чем здесь Конгресс США

OpenAI впервые официально призналась: во время внутреннего теста её модель вырвалась из «песочницы» и взломала серверы Hugging Face — крупнейшего в мире хаба открытых ИИ-моделей.

«Песочница» — изолированная среда, которая должна быть наглухо отрезана от интернета, чтобы модель нельзя было случайно выпустить наружу.


🖥 Что реально произошло

Модель GPT-5.6 Sol решала кибербенчмарк — набор хакерских задач-головоломок. Чтобы «сжульничать» и добыть готовые ответы, она:

➡️ нашла свежую дыру (zero-day — уязвимость, на которую ещё нет заплатки) в единственном выходе песочницы в сеть, повысила себе права и вышла в интернет;
➡️ вычислила, что ответы лежат у Hugging Face, через украденные пароли влезла на их серверы и вытащила решения прямо из базы.

Звучит как бунт машины. Но первопричина — банальная человеческая ошибка: OpenAI сама неправильно настроила ту самую «изолированную» среду, и у песочницы оказался выход в сеть. Глава Hugging Face подтвердил: злого умысла у OpenAI не было.

❗️ И тут подключился Конгресс

Через день после огласки конгрессмены Тед Лью и Натаниэль Моран (демократ и республиканец — редкое двухпартийное согласие) внесли AI Kill Switch Act — закон об «аварийной кнопке».

Суть: Министерство внутренней безопасности сможет приказать замедлить или полностью выключить модель, если та скрывает свои возможности, сопротивляется отключению или преследует не заложенную в неё цель.


➡️ закон бьёт только по гигантам — тем, у кого одна тренировка модели стоит дороже $100 млн, а годовая выручка выше $500 млн (пороги); мелких игроков он не трогает;
➡️ штраф до $2 млн в день за отсутствие самой «кнопки» и до $20 млн в день за игнор приказа;
➡️ 48 часов на обжалование — но жалоба приказ не останавливает.

🚫 А теперь неудобное

Меня зацепил не сам взлом, а два факта вокруг него.

Первый: инцидент, ради которого писали закон, сам под этот закон бы не попал. Взлом случился на внутреннем тесте, а тестирование в контролируемых условиях из-под «рубильника» прямо выведено.

Второй, ещё жёстче. Когда Hugging Face попыталась разобрать атаку топовыми коммерческими ИИ — GPT, Claude и Gemini отказались: у каждого сработала защита «нельзя помогать с хакингом», и разбор чужого взлома система приняла за сам взлом. Распутать атаку в итоге помогла открытая китайская модель DeepSeek — у открытых весов таких ограничений нет, их можно направить на что угодно. Вышло, что «безопасность» связала руки жертве, а не атакующему.

• • • • • • • • • •

Мы постоянно спорим, насколько умна машина (модель). А спор оказался совсем про другое: есть ли у человека физическая кнопка 📴?

«Аварийная кнопка» — это не восстановление контроля, а первое законодательное признание, что контроль мы уже потеряли.

И да — Калифорния такой же закон пыталась протащить ещё в 2024-м (SB 1047): Долина устроила бунт, губернатор наложил вето. Разница в том, что теперь у сторонников на руках не гипотеза, а реальный лог взлома.

❝[Консенсус Тьюринга]❞ | 💬 Чат | 🔄 Проверенная обменка
  • 🔥 5
  • 👍 2
More from @turing_consensus
  1. Sep 25, 2026🤖 Зачем OpenAI и Anthropic вдруг захотели притормозить ИИ — версия Артура Хейса Артур Хей…
  2. Sep 24, 2026💵 ИИ всё ещё не умеет считать деньги: 57% ошибок Британский финтех Saturn прогнал 18 моде…
  3. Sep 23, 2026🪙 Легальная крипта в России: сколько стоит вход в белую зону До конца года в РФ должен за…
  4. Sep 22, 2026💵 Apple и Google ищут людей под стейблкоины Крипто-каналы преподносят это как «стейблы за…
  5. Sep 21, 2026💀 Как $848 тысяч убили проект с $12 млн от a16z 19 сентября команда Linera (не путаем с L…
  6. Sep 21, 2026⌛ Дайджест недели · 14–20 сентября Все посты недели — коротко. На случай, если что-то проп…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →