GPT-6 Astra: Benchmarks spalten die KI-Gemeinde

GPT-6 Astra rückt die Frage nach echtem KI-Fortschritt wieder in den Mittelpunkt
8/10 The Decoder (DE) 04.09.2026 Benchmarks & Evals Frontier-Modelle Research

OpenAI hat GPT-6 Astra vorgestellt, doch die Bewertungen sind gespalten: Während Epoch AI das Modell mit 169 Punkten an der Spitze sieht, bewertet Artificial Analysis es nur auf Vorgänger-Niveau, hinter Claude Fable 5.1. Das Aufsehen erregt vor allem eine spezifische Leistung: Bei ARC-AGI-3 arbeitet Astra erstmals effizienter als der menschliche Durchschnitt. ARC-Prize-Chef François Chollet interpretiert dies nicht als AGI-Beweis, zieht daraus aber den Schluss, dass KI-Fortschritt doppelt so schnell vorangeht wie erwartet – und revidiert seine AGI-Prognose nach oben. Das wirft grundsätzliche Fragen darüber auf, wie Fortschritt in der KI-Entwicklung gemessen werden sollte.

Zum Originalartikel