Google testet manipulationssichere KI-Benchmarks mit Kryptografie

Warum KI-Benchmarks ein Vertrauensproblem haben und wie Google es lösen will
7/10 The Decoder (DE) 28.08.2026 Benchmarks & Evals Frontier-Modelle Labs & Industrie

Google DeepMind arbeitet mit Singapores AI Safety Institute an einer revolutionären Methode zur Evaluierung von KI-Modellen: Doppelblinde Tests mittels Confidential Space, bei denen weder Google die Testfragen noch die Prüfer die Modellgewichte einsehen können. Das Pilotprojekt nutzt Gemini Flash Lite und adressiert ein fundamentales Vertrauensproblem der KI-Industrie – die bisherigen Benchmarks lassen sich leicht optimieren oder sogar manipulieren. Wenn dieser Ansatz zum Standard wird, könnte er die Glaubwürdigkeit von KI-Vergleichen erheblich stärken und der Branche mehr Transparenz bringen.

Zum Originalartikel