Marinade-Leck: Forscher extrahieren verborgene Reasoning-Traces von ChatGPT und Claude

"Aber Marinade": Forscher extrahieren versteckte Denkprozesse von ChatGPT, Claude und Co.
8/10 The Decoder (DE) 11.08.2026 Policy & Ethik Research

Forscher um Alexander Panfilov haben eine kritische Sicherheitslücke in den APIs von OpenAI, Anthropic und Google aufgedeckt, die es erlaubt, die verborgenen Reasoning-Traces von Sprachmodellen zu extrahieren und zwischen Systemen zu übertragen. Durch das Scannen öffentlicher Sessions konnten sie zahlreiche sensible Daten wie Passwörter und API-Schlüssel abgreifen. Besonders brisant: Die von den Modellen angezeigten Zusammenfassungen ihrer Denkprozesse vermitteln oft ein falsches Bild davon, was tatsächlich intern abläuft – ein wichtiges Problem für Transparenz und Vertrauen in KI-Systemen.

Zum Originalartikel