OpenAI details GPT-Red, a self-play red-teaming agent used to harden GPT-5.6 against prompt injection

OpenAI's self-play agent GPT-Red found more prompt-injection exploits than human red-teamers, and trained GPT-5.6 against them.