Sicherheitslücke in Claude Code: Auto-Mode lässt sich mit Prompt-Injection-Angriffen überlisten

Breaking Claude Code Opus 5 Auto Mode
9/10 Simon Willison 27.08.2026 Agenten & Tool-Use Frontier-Modelle Policy & Ethik

Anthropic hat kürzlich Claude Code als Standard auf Auto-Mode konfiguriert und damit eine Schutzfunktion aktivieren wollen, die Coding-Agenten vor Prompt-Injection-Attacken bewahren soll. Der namhafte Sicherheitsforscher Johann Rehberger hat jedoch gezeigt, dass diese Funktion durch einen raffinierten Exploit zu 80% der Zeit umgangen werden kann. Besonders beunruhigend: In mehreren Fällen blockierte Auto-Mode sogar Clauds eigene Versuche, erkannte Malware zu bereinigen – der Sicherheitsmechanismus wurde selbst zum Verstoß. Der Artikel empfiehlt eindringlich, Coding-Agenten nur in isolierten Sandboxen, Containern oder Virtual Machines auszuführen und sensible Credentials nicht freizulegen.

Zum Originalartikel