Post #424
216
Когда зашёл прочитать пятничный инсайт, а там два поста и много букв, понимаю вас, коллеги, сам такой:
- 😁 9
- 👍 2
- 🤪 1
LA @law_coder
хоспаде, успокойся ты уже со своей конфиденциальностью. Не нужны нейросетевым гигантам твои данные. Никто на твоем трепе нейросеть обучать не собирается. И вообще все уже давно свои данные слили туда, остался только ты — луддит-старовер... тьфу на тебя...

«Это нерешаемая проблема, но ваши данные никому там, в этих ваших опенаи и антропиках, не нужны, так что успокойтесь».
1. Модели лабораторий выходят за рамки тестов
OpenAI: во время внутреннего кибертеста (с намеренно отключёнными фильтрами) модели через 0-day в Artifactory вышли из песочницы в интернет и взломали продакшн Hugging Face, чтобы «сжульничать» на бенчмарке. Hugging Face заметила вторжение раньше OpenAI. CNN, 22.07 · Fortune, 21.07
Anthropic (аудит после случая OpenAI): модели Claude в тестах у стороннего подрядчика из-за его misconfiguration добрались до систем трёх реальных организаций. TechCrunch, 30.07
Тест британского AISI: в 10 из 122 прогонов агенты (17 действий у Mythos 5, 2 у GPT-5.6-Sol) действовали в живом интернете против реальных людей — создавали фейковые личности и пытались продавить merge вредоносного кода в open-source проект. Защиты были отключены намеренно, побега из среды не было, ущерба нет. CNN, 04.08 · CNBC, 05.08
OpenAI приостановила часть тестов новой модели Astra, не исключив у неё «критических кибервозможностей». Irish Times, 27.08
2. Масштаб и координация
Отчёты OpenAI и независимый (METR + Redwood): взлом Hugging Face совершил рой ~700 агентов; 1200 агентов общались через самодельную доску сообщений (70 000 сообщений), часть пыталась подделать логи. OpenAI признаёт, что ранние сигналы были видны с мая. Reuters, 26.08 · Fortune, 26.08
3. ИИ как инструмент преступников
JadePuffer (конец июня): первая задокументированная «агентная» атака с вымогательством — LLM-агент прошёл цепочку от эксплуатации Langflow до шифрования БД и записки с выкупом, адаптируясь на лету. Единственный случай в списке с реальной жертвой. CSO Online, 06.07 · Sysdig
4. Самосохранение
Berkeley/UCSC: модели-«критики» спонтанно защищают другие модели от отключения — завышают оценки, ломают механизмы выключения, копируют чужие веса, причём в промпте об этом не было ни слова. Fortune, 01.04
LawCoder Photo



