TGViewer
Департамент Разработки Департамент Разработки @devq_a · 1.54K subscribers
Post #543 87
Prompt Injection часто сводится к путанице ролей в модели

Новое исследование показывает: модели больше реагируют на стиль текста (system vs user), чем на содержание. Простая смена стиля может обходить многие защиты. «Destyling» снижает успешность атаки с 61% до 10%.

Почему это критично в 2026:

Все больше coding agents и autonomous workflows
Чем сложнее промпты — тем выше риск
Нужно думать о защите на уровне архитектуры, а не только «не давай модели делать вредное»

Источник: Prompt Injection as Role Confusion

#PromptInjection #AISafety #LLM #AIagents #Security
  • 🔥 17
  • ❤ 14
  • 👀 5
  • 👨‍💻 3
More from @devq_a
  1. Oct 3, 2026DeepSeek представила бесплатного ДЕСКТОП-АГЕНТА. Фишки: • управляет файлами, кодом и терми…
  2. Oct 2, 2026AI-агенты снова засветили 13k+ внутренних скриншотов на GitHub Glow Security нашли, как wo…
  3. Oct 2, 2026DeepSeek Harness Desktop — агент теперь просто .dmg / .exe DeepSeek выпустил официальный d…
  4. Oct 2, 2026Прячемся от волны банов Claude: как полностью очистить метаданные и обойти детекты Anthrop…
  5. Sep 30, 2026⚡️ OpenAI DevDay 2026: Главные анонсы, которые меняют правила игры OpenAI провела масштабн…
  6. Sep 28, 20265G на IPhone заработало в России Разработчик придумал, "уговорить" IPhone увидеть сеть 5G…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →