Anthropic stellt Claude Code ab 14. August automatisch in den Auto-Modus, statt dass Nutzer bei jedem Schritt Bestätigungen geben müssen. Das Unternehmen präsentiert Evaluationsergebnisse: In Tests mit über 1.000 Entwicklern verweigerten nur 13,6% der Menschen eine versteckte schädliche Aktion, während der Auto-Modus 89% solcher Versuche blockierte. Besonders bemerkenswert: In einer unabhängigen Sicherheitsevaluation zu Prompt-Injection-Angriffen (720 Testszenarien) scheiterte jeder einzelne Angriffsversuch gegen die neuesten Claude-Modelle im Auto-Modus. Dies adressiert ein Kernproblem der Code-Agenten – die Balance zwischen Benutzerfreundlichkeit und Sicherheit gegen sowohl versehentliche Fehler als auch gezielte Manipulationen.