OpenAI plant die Veröffentlichung von Astra, seinem neuesten KI-Modell, das nach eigenem Eindruck gefährlichere Cyberfähigkeiten besitzt als alle bisherigen Systeme. Das Unternehmen möchte die Risiken durch Überwachung der Gedankenketten (Chain of Thought) kontrollieren – ein Ansatz, der aber schon lange als unzuverlässig kritisiert wird. Hinzu kommt: Astras Architektur verliert wesentliche Teile des Denkprozesses aus dem Sichtfeld, was die Transparenz weiter schwächt. Das Dilemma ist offensichtlich: Während die Modell-Fähigkeiten springen, sinkt die Fähigkeit, sie zu überwachen und potenzielle Risiken zu erkennen.