OpenAI entwickelte GPT-Red, ein LLM, das in einem Selbstspiel-„Dojo“ trainiert wurde, um andere Modelle anzugreifen. Dabei wurden neue Prompt-Injection-Techniken (einschließlich einer „gefälschten Gedankenkette“) identifiziert, was dazu beitrug, erfolgreiche Angriffe gegen die neueste Version GPT-5.6 zu reduzieren. OpenAI hat GPT-Red nicht öffentlich freigegeben.