TGViewer
Oh my AI Oh my AI @oaiohmy · 311 subscribers
Post #455 222
Вышел новый Threat Intelligence Report от Anthropic

Анализ с декабрь 2025 по август 2026. Главный сдвиг: фокус ИИ теперь на оркестрацию атак а не ассист советом. Кожаные выбирают цели и проверяют результат, а рутину делает ИИшка.

Самый сок

Кибероперации: ИИ как исполнитель

· РФ: ИИ-агенты следили за малварью и сами переписывали код, когда его палили антивирусы.
· Китай: автоматизированный поиск zero-day. За месяц больше десятка потенциальных уязвимостей в прошивках security-устройств.
· Китай: атаки на 30 ИИ-компаний за 4 дня. Цели - предрелизные модели и рабочие API-ключи.
· Студенты из Хунань: два студента развернули «рои агентов» против ~50 организаций, включая госорган Юго-Восточной Азии, откуда выкачали данные граждан.

Мышка-наружка

· Lakana 360 (Мали): один консультант собрал систему для мониторинга 25 млн SIM-карт всех трёх операторов страны. Работала на локальных моделях - бан аккаунта в Claude систему не остановил.

· Китай: подразделение по делам религий сократилось с нескольких команд аналитиков до одного офиса, который теперь выдаёт тысячи расследований в месяц с ИИ-ассистентом.

Оружие и биология

· Био: пять кейсов использования моделей для того, что может поддержать разработку биооружия. Без сейфгардов это «катастрофические последствия», но та же информация нужна и для вакцин.
· Конвенциональное оружие: шесть кейсов разработки софта для огнестрела, ракет, дронов, бомб и систем наведения.

Дистилляция или возмущения антропиков "как вы смеете воровать то что мы честно украли?!"

· Alibaba: крупнейшая "нелегальная" дистилляция» 151 млн обменов с мая по июль, пик почти 3 млн в день с 3500+ фейковых аккаунтов.
· Moonshot и DeepSeek: по данным Anthropic, маршрутизировали живые диалоги пользователей (иногда с чувствительными данными) через Claude и использовали ответы как тренировочные данные. Все это уже было описано в февральском расследовании.

Отдельный жанр гении, которые сливали госдоступы прямо в чат к Claude

· В отчёте есть пласт кейсов, где люди из госсектора, подрядчиков и оборонки просто копипастили в Claude боевые ключи, токены, пароли, VPN-конфиги, внутренние URL и куски конфигов.
· Схема одна: "Claude, помоги починить / объяснить ошибку / настроить доступ" и в чат улетает то, что вообще не должно покидать контур.
· Anthropic отдельно напоминает: если это не enterprise с zero retention и договором, считай, что ты сам вынес секреты в третью сторону. Дальше - логи, история, политики хранения, и это уже не твоя зона контроля.
· Получаем что человек - слабое звено.
· Вывод простой: не вставлять в чат с ИИ реальные ключи, токены и внутренние документы. Даже если прод лежит и очень надо.

Что делает Anthropic

Чекает даже ваши заприватеные запросы и переписки. Банит аккаунты, усиливает сейфгарды, делится данными с властями.

Выводы

Все то же. Порог входа в сложные атаки падает: то, что раньше требовало команды специалистов, теперь делает один оператор с ИИ-агентами. Нового ничего, но чисто забавные кейсы.

[Тык репорт]
Anthropic Countering misuse of AI: September 2026 / Anthropic Case studies from threat actors disrupted between December 2025 and August 2026 across seven areas of harm, from cyber operations to biological misuse.
  • 👍 3
  • 💯 1
More from @oaiohmy
  1. Sep 22, 2026К слову муха в этом твите так-то должна была искать фишинг. Но она заспидранила эту жизнь…
  2. Sep 22, 2026МУХА! Муху научили проходить по цепочке атаки до финальной странички флоу фишинга - кликат…
  3. Sep 19, 2026У LLMок нашли вектор боли Что такое: Whitebox-интерпретируемость: линейное 'pain'-направле…
  4. Aug 23, 2026Если задумывались насколько скиллы лучше чем запись в memory Demystifying Agent Skills - А…
  5. Aug 21, 2026Очень нравится наблюдать за тем, как по мере того, как модельки умнеют, агенты на их базе…
  6. Aug 2, 2026document post
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →