Eine neue Studie von Princeton und dem UK AI Security Institute widerlegt die optimistischen Aussagen von Anthropic und OpenAI zur autonomen KI-Forschung. Forscher gaben Claude Opus und GPT-5 sechs Tage, 3.000 Dollar und GPU-Zugang für eigenständige Forschungspapiere – Original-Autoren bewerteten alle Ergebnisse mit „Reject". Während die Frontier-Modelle komplexe technische Research-Engineering-Aufgaben meistern, mangelt es ihnen an kritischem Forschungsurteil, echter Kreativität und der Fähigkeit, gescheiterte Strategien rechtzeitig zu verlassen. Die Studie deutet darauf hin, dass vollständig autonome KI-Forschung noch Jahre entfernt ist und die Hype-Rhetorik der großen Labs deutlich über der Realität liegt.