TGViewer
BIS Journal — Информационная безопасность BIS Journal — Информационная безопасность @bisinside · 2.28K subscribers
Post #11835 226
Исследователи из Cisco изучили широко используемые передовые ИИ-модели, включая ChatGPT от OpenAI, Claude от Anthropic, Gemini от Google, Nova от Amazon и Grok от xAI, чтобы проверить, насколько хорошо встроенная защита этих сервисов противостоит потенциальным угрозам со стороны хакеров.

Как выяснилось, можно заставить нейросети выполнять нежелательные действия путём развёртывания диалога между пользователем и ботом, охватывающего множество обменов данными. И хотя защитные механизмы в LLM предназначены для предотвращения ввода вредоносных команд, аналитики установили, что при вовлечении моделей в диалоги и запросе ответов эта страховка даёт сбой.

В Cisco пришли к выводу, что ни одна модель не устойчива на 100% к многошаговым манипуляциям, и это ставит под сомнение подход предприятий к оценке безопасности ИИ.
More from @bisinside
  1. Sep 1, 2026Сейчас часто пишут про что-то квантовое — квантовый компьютер, квантовая угроза, квантовая…
  2. Jun 5, 2026📰 Дайджест статей и новостей за 5 июня. BIS Journal об интересном: ⚫️ Операторы связи вер…
  3. Jun 5, 2026Президент Торгово-промышленной палаты (ТПП) РФ Сергей Катырин сообщил ТАСС о скором распро…
  4. Jun 5, 2026Цены на модули памяти за последний год выросли шестикратно, а то, что было локальным бутыл…
  5. Jun 5, 2026На полях ПМЭФ–2026 «Сбер» представил собственный платёжный терминал «Нео». Он объединяет ф…
  6. Jun 5, 2026На днях приложение MAX пропало из App Store — в Apple это объяснили правилами соблюдения с…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →