TGViewer
AI Attacks AI Attacks @aiattacks · 1.02K subscribers
Post #21 73

Forwarded from Порвали два трояна

🤖 Уже появляются бэкдоры в ИИ-моделях

И мы не про вредоносные библиотеки для «доступа к ChatGPT». Речь про отравление самих моделей, которое приводит либо к срабатыванию вредоносного кода при локальном запуске модели, либо вообще не содержит ВПО, но побуждает модель выдавать неверные ответы на совершенно конкретные запросы. В последнем случае логическая бомба заложена в весах или вычислительном графе нейросети.

Как атакующие могут это проделать — читайте в нашем посте, но основной вывод очевиден. Тщательный контроль происхождения ИИ-инструментов и всех их компонентов, включая сами модели, должен внедряться службами ИБ уже сегодня.

#советы #ИИ #угрозы @П2Т
Блог Касперского Недекларированная функциональность в системах Machine Learning Скрытая логика, отравление выборки и другие способы целевых атак через ИИ-системы.
More from @aiattacks
  1. Sep 30, 2026Раз в неделю я делаю ресерч по новым продуктам, лабораторным в том числе, в ИБ в ML, в ML…
  2. Sep 30, 2026Теперь не только можно купить ВПО, но еще заказать аналитику, чтобы не тратить ресурсы зря…
  3. Sep 30, 2026красиво Северокорейская схема по внедрению фальшивых ИТ-специалистов в западные компании б…
  4. Sep 30, 2026а вот это даже не хе-хе, а Хе-хе-хе (Хуанг мой краш, конечно ) На фоне растущей обеспокоен…
  5. Sep 30, 2026Операторы Kubernetes призваны значительно сократить операционную нагрузку, выступая в роли…
  6. Sep 30, 2026DARWIN рассматривает джейлбрейк как непрерывный эволюционный процесс и постоянно обновляет…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →