Claude Opus 5 soll Prompt-Injection-Angriffe praktisch eliminiert haben

Opus 5 ist laut Anthropic kaum noch anfällig für Prompt-Injection-Angriffe
7/10 The Decoder (DE) 25.07.2026 Agenten & Tool-Use Frontier-Modelle Policy & Ethik

Anthropic gibt bekannt, dass sein neues Modell Opus 5 in Kombination mit dem Auto Mode bei Browser-Agenten eine Prompt-Injection-Erfolgsrate von null Prozent erreicht – getestet in 129 Szenarien. Ohne zusätzliche Schutzschichten liegt die Rate immerhin nur bei 3,7 Prozent. Prompt-Injection ist eine der größten Sicherheitslücken von KI-Agenten im Web, da böswillige Eingaben das Modell manipulieren können. Falls sich diese Ergebnisse in der Praxis bewähren, würde Anthropic ein fundamentales Problem der autonomen KI-Sicherheit gelöst haben.

Zum Originalartikel