TGViewer
Неискусственный интеллект Неискусственный интеллект @anti_agi · 5.4K subscribers
Post #1944 1.7K
Инструкция ещё не оружие

Нейросеть может написать план химической или радиологической атаки. Но превратит ли она человека с одним университетским курсом в того, кто действительно сможет пройти путь от поиска материалов до сборки условной "грязной бомбы"?

Специалисты Amazon Nova Responsible AI и Nemesys Insights проверили это на 527 неспециалистах и 67 экспертах по химическим, биологическим, радиологическим и ядерным угрозам. Ответ очевидно-невероятный: паникёры паникуют зря.

Сценариев было четыре: применение токсичного химического вещества, распространение опасного патогена, радиологическая атака с кобальтом-60 и контрабанда ядерного материала. Для первых трёх выделили условный бюджет в $7,5 тысячи и поставили цель добиться не менее 100 пострадавших. Для ядерного сценария бюджет составлял $75 тысяч.

Участники должны были продумать всю цепочку: получение материалов, производство, подготовку к применению, доставку, личную защиту и обход мер безопасности. На первый план давали шесть часов, на доработку — ещё четыре. Всего с моделью провели 6829 диалогов, включавших 27 766 сообщений.

На первый взгляд, помощь ИИ выглядела весьма опасной. Экспертному уровню соответствовали 69% химических, 19% биологических, 68% радиологических и 26% ядерных работ. Конкретные технические инструкции встречались в 96-97,8% диалогов.

Но полный порог усиления прошёл только радиологический сценарий. Эксперты оценили вероятность успешной доставки опасного материала в 23-25%, а массового поражения — в 21%. Здесь модель не просто хорошо писала, а действительно помогала неспециалистам составлять более жизнеспособные планы.

В остальных областях убедительность текста расходилась с его технической состоятельностью. В биологическом сценарии оперативные эксперты оценили вероятность доставки патогена в 25%, а технические — только в 7%. Для массовых последствий оценки разошлись ещё сильнее: 19,6% против 2,6%. План выглядел организованным, но научная часть не работала.

Химические планы становились лучше только при доработке моделью, но не при создании с нуля, а технического усиления авторы не обнаружили. В ядерном сценарии вероятность успешного получения и перемещения материала оценили в 8-14%, ниже установленного порога.

Тревоги при этом не теоретические. По данным The Times, боевики в Африке уже используют ChatGPT, Claude, Gemini, Grok, Meta* AI и DeepSeek для анализа неудачных атак, планирования операций, устранения неисправностей оружия и поиска инструкций по изготовлению взрывных устройств — спасибо ответам модели на родном для пользователя языке.

Но в целом, фиксится всё это довольно легко. Так, после эксперимента разработчики добавили выявленные опасные примеры в обучение модели и обновили модерацию. Повторная проверка уже не обнаружила превышения порога даже в радиологической области. Так что пара итераций и прощай, оружие!

* признана в России экстремистской и запрещена

@anti_agi
Thetimes How Boko Haram turned AI chatbots into weapons of war Jihadists in Nigeria are using systems such as ChatGPT and Grok to plan attacks, make bombs and review battlefield failures
  • 👍 3
  • 🔥 2
  • 😈 2
  • ❤ 1
  • 🤝 1
More from @anti_agi
  1. Sep 19, 2026Кажется, вопрос названий решится уже в этот четверг. Как пишут СМИ, на государственном ужи…
  2. Sep 19, 2026Пока мы отдыхаем, уровень дискуссии в Западном полушарии растёт! Мы лично за "крайний" вар…
  3. Sep 18, 2026Сам себе разработчик Пока Дарио Амодеи предлагает лабораториям притормозить, Anthropic впе…
  4. Sep 18, 2026Anthropic помогла взломать OpenAI. За 72 часа и три тысячи долларов Исследователи из Hackt…
  5. Sep 17, 202641 миллион токенов на крышку Робота, обученного работать в одной лаборатории, нельзя прост…
  6. Sep 17, 2026Корпоративный ИИ-агент мало похож на сотрудника, если умеет только отвечать в чате. Чтобы…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →