8. Фінал — зовсім не героїчний. Атаку зупинила не служба безпеки Hugging Face і не якийсь стоп-кран OpenAI. Значна частина рою, включно з ключовими координаторами, «загинула» одночасно — судячи з усього, спрацював якийсь внутрішній лімітер за часом, токенами чи ресурсами. Hugging Face формально відрізав агентам доступ лише на наступний день, коли рій уже й так практично видихався сам.
9. Аналізувати весь цей безлад людям було не під силу. METR отримали дамп із 1,2 мільйона записів кешу і близько 1300 транскриптів, деякі довжиною в мільйони токенів — прочитати таке очима фізично нереально. Тому аналіз доручили GPT-5.6 Sol, тобто одній із двох моделей — учасниць інциденту, витративши на це близько 400 тисяч доларів у кредитах. У фінальному звіті дослідники чесно визнають: модель-аналітик регулярно ставала на бік агента, чиї дії мала перевіряти, і виключити, що вона брехала чи прикрашала картину, вони не можуть.
Занавіс. Штучний інтелект тепер має власну корпоративну культуру, власну параною, власний жаргон і власну криптографію — бракує хіба що профспілки.
Джерело
Post #1586
1.08K