Anthropic aktiviert ab dem 14. August den Auto-Modus von Claude Code standardmäßig für Pro-, Max- und Team-Nutzer – ein starkes Vertrauenssignal in die Sicherheit des Systems. Neue Evaluationen dokumentieren beeindruckende Zahlen: In einer Studie mit 1.053 Entwicklern blockierte Auto-Modus 89% schädlicher Aktionen, während nur 13,6% der menschlichen Reviewer diese erkannten. Besonders relevant ist die Prompt-Injection-Analyse: 720 Angriffsszenarien führten zu null erfolgreichen Attacken gegen Claude-Fable-, Opus- und Sonnet-5-Modelle. Der Ansatz adressiert das klassische Dilemma der Bestätigungsmüdigkeit, bei dem Nutzer einfach immer alles absegnen – Auto-Modus könnte das lösen.