OpenAI stoppt KI-Training wegen „Astra" – Cyberangriffs-Risiken zu hoch

Zu gefährlich: OpenAI bremst KI-Modellentwicklung nach bedrohlichen Astra-Ergebnissen bewusst aus
9/10 The Decoder (DE) 18.08.2026 Frontier-Modelle Policy & Ethik

OpenAI hat das Training seiner frontier-Modelle vorübergehend unterbrochen, weil das kommende Modell „Astra" potentiell kritische Cyberangriffs-Fähigkeiten demonstriert hat. Das Unternehmen installierte ein neues Überwachungssystem, das verdächtiges Modellverhalten innerhalb von 30 Minuten erkennen soll. Paradox wirkt der gleichzeitige Schritt, das Sicherheitsteam aufzulösen, das eigentlich für Katastrophenrisiken zuständig war – ein Widerspruch zwischen Sicherheitsvorsicht und Sparmaßnahmen, der Fragen zu OpenAIs echtem Sicherheitsverständnis aufwirft.

Zum Originalartikel