Claude Opus 5 ist laut Boris Cherny von Anthropic das Modell mit der geringsten Anfälligkeit für Prompt-Injections. Dies wird durch umfassende interne Evaluierungen und Red-Teaming belegt, wie in Anthropic's System Card dokumentiert. Prompt-Injection ist eine kritische Sicherheitslücke, bei der Nutzer versuchen, das Verhalten eines LLM durch gezielt formulierte Eingaben zu manipulieren. Diese Verbesserung der Robustheit ist ein wichtiger Fortschritt für die praktische Sicherheit von KI-Systemen in produktiven Umgebungen.