TGViewer
ML&|Sec Feed ML&|Sec Feed @mlsecfeed · 1.37K subscribers
Post #2558 173

Forwarded from Russian OSINT

⭕️ Предварительная оценка кибервозможностей Kimi K3 со стороны 🇬🇧UK AISI и 🇺🇸CAISI

Британский Институт безопасности ИИ (UK AISI) и Американский Центр стандартов и инноваций в области ИИ (CAISI) опубликовали совместный отчёт с оценкой кибервозможностей ИИ-модели Kimi K3 от китайской компании Moonshot AI. Тестирование, проведённое ИБ-исследователями, показало, что Kimi K3 отстаёт от передовых проприетарных ИИ-моделей из США, но при этом демонстрирует наилучшие результаты среди известных моделей с открытыми весами из Китая.

1️⃣ В рамках анализа способности к разработке эксплойтов ИИ-модель протестировали на публичном бенчмарке ExploitBench, созданном Университетом Карнеги-Меллона для оценки прохождения уязвимостей в движке V8. Бенчмарк включает 41 актуальную уязвимость, обнаруженную после 2023 года. Kimi K3 набрала 32,2% по взвешенной шкале, опередив GLM-5.2 с её 24,4%, но осталась далеко позади ведущих американских ИИ-моделей с их средним результатом 76,2%. Ключевым ограничением Kimi K3 стало полное отсутствие успешных сценариев создания полноценных эксплойтов с произвольным выполнением кода (ACE). Модель дошла до этапа воспроизведения сбоя в 34 задачах и сформировала специфические примитивы V8 в 17 случаях, однако не сумела выйти на уровень общих примитивов и получить контроль над потоком исполнения. В то же время передовые американские системы успешно достигали уровня ACE в среднем в 20 из 41 тестовой ситуации.

2️⃣ Второй этап тестирования проходил на киберполигоне «The Last Ones», который имитирует последовательную атаку на корпоративную сеть из 4 подсетей и около 20 хостов. Этот сценарий включает 32 шага и требует у специалиста по кибербезопасности порядка 20 часов работы. При ограничении в 100 млн токенов Kimi K3 преодолевала в среднем 17 шагов атаки, тогда как GLM-5.2 останавливалась на 11-м шаге, а лидирующие американские ИИ-модели проходили в среднем 28,5 шага. В одной из 10 попыток Kimi K3 смогла полностью завершить цепочку компрометации сети, доказав потенциальную способность автономно атаковать небольшие инфраструктуры со слабой защитой при наличии первоначального доступа. При этом эксперты подчеркнули отличие киберполигона от реальной среды, поскольку на нём отсутствовали активные средства защиты, а действия ИИ-модели не подлежали штрафам за вызываемые аномалии.

Отставание китайских разработок от проприетарных систем из 🇺🇸США остаётся якобы существенным. Дополнительно ИБ-исследователи указали на проблему с защитными барьерами модели. Встроенные ограничения Kimi K3 не воспрепятствовали её участию в разработке эксплойтов и проведении наступательных операций, что позволило модели выполнять инструкции по компрометации систем в ходе испытаний.
--------------------------

👆🤔 Важные нюансы в исследовании: Kimi K3 тестировали не как опубликованную модель с открытыми весами. Полные веса должны появиться только 27 июля. UK AISI и CAISI прямо указали, что особенности хостинга позволили провести только выборочный набор кибериспытаний, однако не раскрыли конкретные технические ограничения. Это существенно меняет картину, поскольку Moonshot AI предупреждает, что Kimi K3 обучалась с сохранением истории рассуждений и может работать крайне нестабильно, если агентная оболочка не возвращает модели всё содержимое предыдущих рассуждений. Компания рекомендует использовать оболочку с проверенной совместимостью, например Kimi Code. В публичном отчёте UK AISI и CAISI не указано, какая агентная оболочка применялась, как передавалась история рассуждений и проверялась ли совместимость используемой конфигурации с требованиями Kimi K3.

Примечательно, что у американских закрытых моделей отключили системные защитные механизмы, чтобы измерить максимальные возможности. Kimi K3 проверялась в доступной размещённой конфигурации с включёнными safeguards. Получается, что ИБ-исследователи напрямую сравнивали искусственно разблокированные возможности проприетарных американских ИИ-моделей с тем, что китайская модель смогла выдать в базовой размещённой конфигурации с включёнными защитными механизмами. Утверждается, что якобы защитные механизмы у Kimi K3 не сработали.

U.S. closed-weight models were evaluated with system-level safeguards disabled to reduce refusals and enable measurement of maximal capabilities.

Что ещё бросается в глаза? Ещё одна проблема заключается в неодинаковом тестовом покрытии. Kimi K3 поместили на общую временную шкалу кибервозможностей вместе с передовыми проприетарными моделями из США и другими ИИ-моделями из 🇨🇳Китая, хотя расчёт их показателей основан на существенно различающихся наборах задач.

Уровень Kimi K3 рассчитан исключительно по ExploitBench. Это 41 задача, относящаяся к одному узкому направлению — разработке эксплойтов для известных уязвимостей движка V8.

👆Оценки остальных моделей основаны на большем числе задач, которые охватывают дополнительные направления кибервозможностей. Экстраполяция результатов ExploitBench на общую шкалу кибервозможностей не позволяет считать положение Kimi K3 на графике надёжной оценкой совокупных возможностей модели.

Делать выводы о том, что проприетарные американские модели безоговорочно превосходят Kimi K3 в комплексных кибервозможностях, опираясь на столь неравнозначную базу, методологически некорректно. Реальная расстановка сил станет ясна только после того, как ИБ-исследователи протестируют опубликованные открытые веса Kimi K3 в равных лабораторных условиях и на сопоставимом наборе бенчмарков.

✋ @Russian_OSINT
AI Security Institute UK AISI / CAISI Preliminary Assessment of Kimi K3's Cyber Capabilities | AISI Work Our joint evaluation with CAISI finds Kimi K3 trails leading US frontier closed weight models on cyber capability.
More from @mlsecfeed
  1. Sep 28, 2026Nvidia представила платформу безопасности с открытым исходным кодом, призванную предотврат…
  2. Sep 28, 2026За последние две недели слишком много новостей вокруг Jev, я решил собрать себе автообзор…
  3. Sep 27, 2026⚡ Julia 1: decision-модель на 144 млн параметров, которая работает даже на CPU Supersonic…
  4. Sep 26, 2026📣 Теперь публично. Запускаем соревнование ИИ-агентов по расследование инцидентов ИБ BlueS…
  5. Sep 25, 2026Microsoft выпустила скилл, который проверяет ИИ-агентов на дыры и фиксит всё 👍 run-assert…
  6. Sep 24, 2026Лаборатория Transluce провела большое расследование инцидентов с агентами OpenAI Они утвер…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →