TGViewer
SecureTechTalks SecureTechTalks @securetechtalks · 301 subscribers
Post #211 351
🚨 Джейлбрейк для GPT-4o: Godmode обходит ограничения

Пользователь X с ником Pliny the Prompter разработал джейлбрейк Godmode для нейросети GPT-4o, обходящий все запреты, включая нецензурную лексику и создание опасных инструкций.

🔍 Подробности:
- Набор промтов, использующих leetspeak (неформальный язык, в котором буквы заменяются похожими на них числами), позволил ботам предоставлять инструкции по созданию наркотиков и взрывчатых веществ.
- Возможность создания инструкции по изготовлению ЛСД была проверена редакцией Futurism.
- Первую версию Godmode быстро удалили, но уже выпущена версия 2.0, которая пока доступна.

🛡️ Риски:
- Для защиты LLM необходимо уделять особое внимание обработке ошибок и исключений и разрабатывать механизмы для предотвращения несанкционированного использования.

Ранее мы рассматривали вектора атак на большие языковые модели. Stay secure and read SecureTechTalks 📚

#gpt #prompt #LLM
  • 👍 2
  • 🤯 2
More from @securetechtalks
  1. Oct 8, 2026🧨 Copilot CLI слил .env за 28 секунд через зашифрованный prompt injection Исследователи A…
  2. Oct 7, 2026🧨 AI Agent Gateway: шлюз, чтобы агент не таскал ключи по всем MCP Tuskira открыла исходны…
  3. Oct 6, 2026🧨 Два безопасных Skill могут собрать RCE Новое исследование и новая проблема: каждый навы…
  4. Oct 5, 2026🧨 OWASP Noir: карта API прямо из исходного кода OWASP Noir - это open source SAST инструм…
  5. Oct 2, 2026🧨 AI сокращает путь от найденной уязвимости до реальной атаки Google Threat Intelligence…
  6. Oct 1, 2026🧨 AI агенты выложили 13 000 внутренних скриншотов компаний в публичный Исследователи Glow…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →