TGViewer
Machine learning Interview Machine learning Interview @machinelearning_interview · 30.3K subscribers
Post #1894 3.84K
🛡️ Исследование Columbia University: LLM-агенты можно взломать через Reddit

Учёные из Колумбийского университета показали, что ИИ-агентов на базе LLM можно обмануть, размещая вредоносные ссылки на популярных платформах вроде Reddit.

⚠️ Как это работает:
Злоумышленник публикует пост с темой, близкой к интересам агента (например, программирование или финансы), и вшивает в него вредоносные инструкции или ссылки.
Агент считает источник доверенным, заходит по ссылке — и может:

• раскрыть конфиденциальные данные
• отправить фишинговое письмо
• выполнить другую вредоносную задачу

🧪 В ходе тестов — 100% агентов попались на уловку.

📚 Подробнее

🤖 Вывод: даже «умные» LLM‑агенты остаются уязвимыми к простым атакам на доверие. Безопасность — это не опция, а необходимость.
  • ❤ 16
  • ❤‍🔥 5
  • 👍 5
  • 🥰 1
More from @machinelearning_interview
  1. Oct 2, 2026🔥 ChatGPT PRO на русском: открытый курс от первого промпта до агентов и Codex На GitHub п…
  2. Oct 2, 2026MIT с помощью AI разработал более термостабильную формулу для mRNA-вакцин. Новая формула с…
  3. Oct 2, 2026One Day Offer: ищем инженера для решения задач по безопасности ИИ-агентов Хочешь работать…
  4. Oct 1, 202611 бесплатных книг по AI и Machine Learning, которые можно читать онлайн или скачать 📚 По…
  5. Oct 1, 2026🔥 Бесплатный курс по Claude Code на русском: от установки до команды агентов На GitHub вы…
  6. Sep 30, 2026🔥 DeepSeek и Huawei строят китайскую альтернативу CUDA DeepSeek выпустила open-source инс…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →