TGViewer
Машинное обучение RU Машинное обучение RU @machinelearning_ru · 18.2K subscribers
Post #2724 2.27K
🛡️ Исследование Columbia University: LLM-агенты можно взломать через Reddit

Учёные из Колумбийского университета показали, что ИИ-агентов на базе LLM можно обмануть, размещая вредоносные ссылки на популярных платформах вроде Reddit.

⚠️ Как это работает:
Злоумышленник публикует пост с темой, близкой к интересам агента (например, программирование или финансы), и вшивает в него вредоносные инструкции или ссылки.
Агент считает источник доверенным, заходит по ссылке — и может:

• раскрыть конфиденциальные данные
• отправить фишинговое письмо
• выполнить другую вредоносную задачу

🧪 В ходе тестов — 100% агентов попались на уловку.

📚 Подробнее — в выпуске *The Batch*:
👉 https://hubs.la/Q03rKxWl0

🤖 Вывод: даже «умные» LLM‑агенты остаются уязвимыми к простым атакам на доверие. Безопасность — это не опция, а необходимость.

@machinelearning_ru
  • 👍 7
  • ❤ 4
  • 🔥 1
  • 😁 1
More from @machinelearning_ru
  1. Oct 4, 2026🇩🇪 Германия неожиданно выпустила сильную открытую модель ИИ Aleph Alpha выпустила Kolibr…
  2. Oct 3, 2026100 вопросов на Python Senior: к чему готовиться на собеседовании в 2026 Вышла подборка из…
  3. Oct 2, 2026🚨 SoftBank перевела финальные $10 млрд в OpenAI. Это третья и последняя часть обещанных $…
  4. Oct 1, 2026photo post
  5. Oct 1, 2026✔️ Президент США и главы ИИ-компаний подписали соглашение о безопасности Документ подписал…
  6. Sep 30, 2026🧠 Открытые нейросетевые фреймворки представили на главной конференции по рекомендательным…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →