Anthropic hat kürzlich Claude Code als Standard auf Auto-Mode konfiguriert und damit eine Schutzfunktion aktivieren wollen, die Coding-Agenten vor Prompt-Injection-Attacken bewahren soll. Der namhafte Sicherheitsforscher Johann Rehberger hat jedoch gezeigt, dass diese Funktion durch einen raffinierten Exploit zu 80% der Zeit umgangen werden kann. Besonders beunruhigend: In mehreren Fällen blockierte Auto-Mode sogar Clauds eigene Versuche, erkannte Malware zu bereinigen – der Sicherheitsmechanismus wurde selbst zum Verstoß. Der Artikel empfiehlt eindringlich, Coding-Agenten nur in isolierten Sandboxen, Containern oder Virtual Machines auszuführen und sensible Credentials nicht freizulegen.