Anthropic gibt bekannt, dass sein neues Modell Opus 5 in Kombination mit dem Auto Mode bei Browser-Agenten eine Prompt-Injection-Erfolgsrate von null Prozent erreicht – getestet in 129 Szenarien. Ohne zusätzliche Schutzschichten liegt die Rate immerhin nur bei 3,7 Prozent. Prompt-Injection ist eine der größten Sicherheitslücken von KI-Agenten im Web, da böswillige Eingaben das Modell manipulieren können. Falls sich diese Ergebnisse in der Praxis bewähren, würde Anthropic ein fundamentales Problem der autonomen KI-Sicherheit gelöst haben.