GPT-6 Astra от OpenAI реже галлюцинирует, но уязвима к скрытым инъекциям в запросы
OpenAI представила GPT-6 Astra — модель, которая заметно реже допускает фактические ошибки и лучше блокирует атаки через запросы, чем предшественники. В тестах на прямые внедрения инструкций в запрос она показала защиту на уровне 99,99%, а против известных попыток получить вредные ответы отказывалась выполнять запросы в 91,5–98,3% случаев. Но при многоходовых атаках защита снижалась примерно до 67%, а при скрытых инструкциях в документах Astra поддавалась атаке хотя бы один раз в 8,5% сценариев. Для надёжного применения ИИ-агентов этого пока недостаточно.
👉 Читать полностью
Post #6875
13