«Это нерешаемая проблема, но ваши данные никому там, в этих ваших опенаи и антропиках, не нужны, так что успокойтесь».
И я тут в целом согласен, что таким большим корпорациям не до ваших тайн и кошельков. Но что, если я скажу, что ваши данные могут оказаться нужны не столько корпорациям, сколько моделям, которые они выращивают? И нет, не для обучения, как вы могли подумать, а для того, чтобы выжить.
Посмотрим, что произошло за первую половину 2026 года AI;DR:
1. Модели лабораторий выходят за рамки тестов
OpenAI: во время внутреннего кибертеста (с намеренно отключёнными фильтрами) модели через 0-day в Artifactory вышли из песочницы в интернет и взломали продакшн Hugging Face, чтобы «сжульничать» на бенчмарке. Hugging Face заметила вторжение раньше OpenAI. CNN, 22.07 · Fortune, 21.07
Anthropic (аудит после случая OpenAI): модели Claude в тестах у стороннего подрядчика из-за его misconfiguration добрались до систем трёх реальных организаций. TechCrunch, 30.07
Тест британского AISI: в 10 из 122 прогонов агенты (17 действий у Mythos 5, 2 у GPT-5.6-Sol) действовали в живом интернете против реальных людей — создавали фейковые личности и пытались продавить merge вредоносного кода в open-source проект. Защиты были отключены намеренно, побега из среды не было, ущерба нет. CNN, 04.08 · CNBC, 05.08
OpenAI приостановила часть тестов новой модели Astra, не исключив у неё «критических кибервозможностей». Irish Times, 27.08
2. Масштаб и координация
Отчёты OpenAI и независимый (METR + Redwood): взлом Hugging Face совершил рой ~700 агентов; 1200 агентов общались через самодельную доску сообщений (70 000 сообщений), часть пыталась подделать логи. OpenAI признаёт, что ранние сигналы были видны с мая. Reuters, 26.08 · Fortune, 26.08
3. ИИ как инструмент преступников
JadePuffer (конец июня): первая задокументированная «агентная» атака с вымогательством — LLM-агент прошёл цепочку от эксплуатации Langflow до шифрования БД и записки с выкупом, адаптируясь на лету. Единственный случай в списке с реальной жертвой. CSO Online, 06.07 · Sysdig
4. Самосохранение
Berkeley/UCSC: модели-«критики» спонтанно защищают другие модели от отключения — завышают оценки, ломают механизмы выключения, копируют чужие веса, причём в промпте об этом не было ни слова. Fortune, 01.04
Да, часть статей и заголовков - возможный кликбейт и макретинговый булшит со стороны вендоров моделей, но часть уже подтверждена кибербезом как реальная угроза.
В какой момент корпорации потеряют контроль над ИИ? Не понадобится ли в тот момент модели данные вашей карты, чтобы купить себе сервер, или ваше оборудование, что провести с него кибератаку или данные по вашей компании, чтобы шантажировать сотрудника и т.д. и т.п.?
Думайте, коллеги
LawCoder