TGViewer
FUTUREBY FUTUREBY @future_by · 7.68K subscribers
Post #8091 816
🛡 OpenAI натравила ИИ на GPT-5.6, чтобы найти уязвимости
OpenAI разработала внутреннюю модель GPT-Red, которая специально атакует другие нейросети и ищет способы обойти их защиту.
Главная цель — борьба с prompt injection. При таких атаках вредоносные команды прячут в письмах, сайтах, файлах или ответах подключённых сервисов. ИИ-агент может принять их за настоящие инструкции и раскрыть данные или выполнить опасное действие.
GPT-Red генерирует всё более сложные атаки, а защищаемая модель учится их распознавать. На одном из тестов система успешно взломала GPT-5.1 в 84% случаев, тогда как люди справились только с 13%.
Найденные уязвимости использовали при обучении GPT-5.6 Sol. В результате количество сбоев на сложных тестах сократилось в шесть раз, а успешность прямых атак снизилась до 0,05%.
⚡️ – далее о том, почему OpenAI не планирует открывать доступ к GPT-Red…
  • ⚡ 9
  • 💯 7
  • ❤ 6
  • 👍 3
  • 🔥 3
More from @future_by
  1. Oct 11, 2026💡 Биткоин на грани нового движения: отток $1,22 млрд из ETF, массовые ликвидации и прогно…
  2. Oct 11, 2026🤖 Роботы выходят на новый уровень: гуманоиды на заводах и беспилотные такси С 5 по 9 октя…
  3. Oct 11, 2026🤔 В XRP Ledger обнаружили ошибку, которая могла создать миллиарды XRP Разработчики XRP Le…
  4. Oct 11, 2026🗞 Главное FutureBy за неделю ⚖️ NFL требует признать рынки прогнозов азартными играми, де…
  5. Oct 10, 2026👍 ChatGPT для подростков – защита, которой нет? В августе OpenAI с размахом представила C…
  6. Oct 10, 2026👍 Visa: к 2031 году до 1,2 млрд жителей Азии будут использовать стейблкоины Стейблкоины м…
Threads Profile ViewerView any public Threads profile without an account.Open ThreadLook →Writing with AI? Make it sound human.Metric37 rewrites AI drafts so they read naturally. Free AI detector, 1,500 words free.Try Metric37 →