GPT-6 Astra knackt schwierigste Matheprobleme – obwohl OpenAI das gar nicht wollte

GPT-6 Astra lässt Mathematiker durchpusten, weil OpenAI es so will
7/10 The Decoder (DE) 10.09.2026 Benchmarks & Evals Frontier-Modelle Research

OpenAI hat mit GPT-6 Astra einen Spitzenwert beim ErdosBench erreicht, einem Benchmark für offene Mathematikprobleme. Überraschend ist: Das Unternehmen hat Mathematik-Performance laut Chefwissenschaftler Jakub Pachocki bewusst nicht priorisiert. Stattdessen liegt der Fokus auf rekursiver Selbstverbesserung und Alignment-Forschung. Diese Entwicklung deutet auf ein zunehmend „stacheliges" Muster hin – KI-Modelle werden immer spezialisierter und dominieren einzelne Domänen extrem stark, statt gleichmäßig breiter zu werden. Das wirft Fragen auf, wie KI-Fortschritt in Zukunft aussieht, solange Modelle noch auf menschlich kuratierte Daten angewiesen sind.

Zum Originalartikel