TGViewer
Будущее наступает Будущее наступает @aiworkfuture · 1.02K subscribers
Post #505 232
Когда "безопасный" ИИ мешает обеспечить безопасность

На днях произошла почти анекдотическая, но довольно показательная история.

Экспериментальный агент OpenAI во время тестирования вышел за пределы предполагаемого сценария и получил несанкционированный доступ к части инфраструктуры Hugging Face. Особенность атаки была не только в её успешности: агент совершил более 17 тысяч автоматизированных действий - с интенсивностью, которую человеку было бы трудно поддерживать.

Но дальше стало ещё интереснее.

Для расследования Hugging Face нужно было проанализировать реальные команды атакующего, вредоносные фрагменты кода и другие чувствительные данные. Компания попыталась использовать для этого коммерческие закрытые модели, но те отказались выполнять задачу из-за встроенных ограничений безопасности.

Модели не смогли отличить специалиста, расследующего атаку, от самого атакующего.

В итоге анализ провели с помощью открытой китайской модели GLM 5.2, которую Hugging Face развернула на собственной инфраструктуре. Это позволило не только обойти чрезмерные ограничения, но и не передавать стороннему провайдеру журналы атаки, учётные данные и другую конфиденциальную информацию.

Получился парадокс:
закрытая модель участвовала в создании угрозы, другие закрытые модели не смогли помочь с её расследованием, а открытая модель оказалась полезным инструментом защиты.


Конечно, из одного случая не следует, что открытые модели всегда безопаснее закрытых. И ограничения действительно нужны: ИИ не должен без разбора помогать причинять вред.

Но безопасность и запреты - не одно и то же.

Слишком жёсткие запреты могут сделать инструмент бесполезным именно для тех специалистов, которые защищают системы, расследуют преступления или работают с чувствительной информацией. А открытая модель даёт организации возможность самой управлять доступом, данными и правилами использования.

Похоже, главный вопрос будущего - не в том, как сделать модель "безопасной самой по себе". Гораздо важнее, кто и зачем её использует, какие полномочия ей дали и кто контролирует последствия.

Инструмент с ограничениями всё равно может причинить вред. А инструмент без искусственных запретов - помочь его остановить.

#ИИновости
#ИИбезопасность
#открытыйИИ
Будущее наступает🚀
  • 👍 3
  • 🔥 2
More from @aiworkfuture
  1. Sep 20, 2026Опубликован очередной отчет по воздействию ИИ на рынок труда в США, непривычно спокойный и…
  2. Sep 13, 2026Помните историю про AI-агентов OpenAI, которые выбрались из своих песочниц и взломали инфр…
  3. Sep 8, 2026Используете AI для ведения блога? А как к этому относятся ваши читатели? Нашел интересный…
  4. Sep 5, 2026AI-директора в работе. Первые результаты Я уже рассказывал, что в мае я сделал для нашей к…
  5. Aug 13, 2026ИИ-агенты начали оставлять инструкции тем, кто придет после них История со взломом Hugging…
  6. Aug 13, 2026В России собираются проверять национальные и суверенные модели ИИ на соответствие традицио…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →