TGViewer
LawCoder LawCoder @law_coder · 1.17K subscribers
Post #416 507
Если вы спросите любой ИИ-легалтех-сервис или преподавателя на курсе «ИИ в работе юриста» о том, как они решают проблему утечки персональных данных и конфиденциальной информации третьим лицам, то в большинстве случаев получите такой ответ:
«Это нерешаемая проблема, но ваши данные никому там, в этих ваших опенаи и антропиках, не нужны, так что успокойтесь».

И я тут в целом согласен, что таким большим корпорациям не до ваших тайн и кошельков. Но что, если я скажу, что ваши данные могут оказаться нужны не столько корпорациям, сколько моделям, которые они выращивают? И нет, не для обучения, как вы могли подумать, а для того, чтобы выжить.

Посмотрим, что произошло за первую половину 2026 года AI;DR:
1. Модели лабораторий выходят за рамки тестов
OpenAI: во время внутреннего кибертеста (с намеренно отключёнными фильтрами) модели через 0-day в Artifactory вышли из песочницы в интернет и взломали продакшн Hugging Face, чтобы «сжульничать» на бенчмарке. Hugging Face заметила вторжение раньше OpenAI. CNN, 22.07 · Fortune, 21.07

Anthropic (аудит после случая OpenAI): модели Claude в тестах у стороннего подрядчика из-за его misconfiguration добрались до систем трёх реальных организаций. TechCrunch, 30.07

Тест британского AISI: в 10 из 122 прогонов агенты (17 действий у Mythos 5, 2 у GPT-5.6-Sol) действовали в живом интернете против реальных людей — создавали фейковые личности и пытались продавить merge вредоносного кода в open-source проект. Защиты были отключены намеренно, побега из среды не было, ущерба нет. CNN, 04.08 · CNBC, 05.08

OpenAI приостановила часть тестов новой модели Astra, не исключив у неё «критических кибервозможностей». Irish Times, 27.08

2. Масштаб и координация
Отчёты OpenAI и независимый (METR + Redwood): взлом Hugging Face совершил рой ~700 агентов; 1200 агентов общались через самодельную доску сообщений (70 000 сообщений), часть пыталась подделать логи. OpenAI признаёт, что ранние сигналы были видны с мая. Reuters, 26.08 · Fortune, 26.08

3. ИИ как инструмент преступников
JadePuffer (конец июня): первая задокументированная «агентная» атака с вымогательством — LLM-агент прошёл цепочку от эксплуатации Langflow до шифрования БД и записки с выкупом, адаптируясь на лету. Единственный случай в списке с реальной жертвой. CSO Online, 06.07 · Sysdig
4. Самосохранение
Berkeley/UCSC: модели-«критики» спонтанно защищают другие модели от отключения — завышают оценки, ломают механизмы выключения, копируют чужие веса, причём в промпте об этом не было ни слова. Fortune, 01.04

Да, часть статей и заголовков - возможный кликбейт и макретинговый булшит со стороны вендоров моделей, но часть уже подтверждена кибербезом как реальная угроза.

В какой момент корпорации потеряют контроль над ИИ? Не понадобится ли в тот момент модели данные вашей карты, чтобы купить себе сервер, или ваше оборудование, что провести с него кибератаку или данные по вашей компании, чтобы шантажировать сотрудника и т.д. и т.п.?

Думайте, коллеги

LawCoder
  • 😁 4
  • 🌚 3
  • 🤔 2
More from @law_coder
  1. Sep 18, 2026Когда зашёл прочитать пятничный инсайт, а там два поста и много букв, понимаю вас, коллеги…
  2. Sep 18, 2026Пятничный инсайт Часть 2 У нас уже есть задокументированный случай, когда студент вышел из…
  3. Sep 18, 2026Пятничный инсайт Бесконечно скучно от того, что в сфере ИИ нет движения в сторону западног…
  4. Sep 11, 2026Пятничный инсайт Главный вопрос которого: "С чего вы взяли, что отобрав рутину, сделаете н…
  5. Sep 10, 2026В следующий раз когда кто-то вам скажет: хоспаде, успокойся ты уже со своей конфиденциальн…
  6. Sep 9, 2026Для тех, у кого, как и у меня, закончилось место на телефоне, но очень хочется установить…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →