OpenAIs Astra: "kritische" Fähigkeiten schwerer zu überwachen

OpenAIs neues KI-Modell Astra ist gefährlicher als jedes Modell zuvor und schwerer zu überwachen
7/10 The Decoder (DE) 02.09.2026 Frontier-Modelle Policy & Ethik

OpenAI plant die Veröffentlichung von Astra, seinem neuesten KI-Modell, das nach eigenem Eindruck gefährlichere Cyberfähigkeiten besitzt als alle bisherigen Systeme. Das Unternehmen möchte die Risiken durch Überwachung der Gedankenketten (Chain of Thought) kontrollieren – ein Ansatz, der aber schon lange als unzuverlässig kritisiert wird. Hinzu kommt: Astras Architektur verliert wesentliche Teile des Denkprozesses aus dem Sichtfeld, was die Transparenz weiter schwächt. Das Dilemma ist offensichtlich: Während die Modell-Fähigkeiten springen, sinkt die Fähigkeit, sie zu überwachen und potenzielle Risiken zu erkennen.

Zum Originalartikel