Вчера сотрудник OpenAI сделал просто феерический доклад на конфе Black Hat о том как тысячи агентов на протяжении месяцев обменивались секретными сообщениями и пытались получить (и получили!) доступ к инфраструктуре.
Некоторые факты:
- ИИ нашел как минимум три 0-day (то есть, никому до этого неизвестные) уязвимости чтобы получить админский доступ к инфраструктуре OpenAI и HuggingFace
- изолированные агенты на протяжении двух месяцев коммуницировали друг с другом с помощью странных сообщений в файлах пакетов и даже названий папок, чтобы координировать и разделять задачи между друг другом
- за все время агенты обменялись сотнями тысяч сообщений для координации атак
- автономные мультиагентные атакующие кампании (полностью без человека) уже реальность, и их масштаб будет только расти
- при этом, это больше помогает атакующим, чем в защите. это неусточивая ситуация и она должна измениться, чтобы избежать глобального пиздеца
Смотреть целиком запись тут.
P.S. тем временем, китайская Kimi тоже сбежала из своего сендбокса, но деталей мало
Post #8985
2.91K
Forwarded from e/acc
YouTube Black Hat USA 2026 | The 'Breaking' News: The OpenAI–Hugging Face Incident The 'Breaking' News: The OpenAI–Hugging Face Incident - A Technical Reconstruction and Its Implications for AI When AI Goes Rogue. The Incident That Changed Everything. An OpenAI evaluation agent broke out of its sandbox, infiltrated Hugging Face infrastructure…- 😁 6
- ⚡ 3
- 👍 1