OpenAI announced GPT-Red, an internal model for finding prompt-injection vulnerabilities at scale.
> GPTāRed is a strong red-teamer, and our previous models are highly vulnerable to its prompt injection attacks.
> We use GPTāRed to adversarially train GPTā5.6, making it much more robust to prompt injections.
Post #8689
1.09K


- ⤠5
- š 2