Claude Opus 5 hat einen deutlichen Durchbruch bei logischem Denken erzielt und den ARC-AGI-3-Benchmark, einen der anspruchsvollsten Tests für KI-Intelligenz, mit 30,2 Prozent fast vervierfacht. Das besondere: Das Modell formulierte erstmals eigenständig Spiegelungsgleichungen – eine Fähigkeit, die bis dahin bei keinem anderen Modell beobachtet wurde. Dies deutet auf einen fundamentalen Fortschritt in der Fähigkeit hin, komplexe logische Probleme zu lösen. Der ARC-AGI-Benchmark gilt als eine der härtesten Prüfungen für allgemeine Intelligenz bei KI-Systemen, daher ist dieser Durchbruch ein bedeutsamer Meilenstein für Anthropic und die KI-Industrie insgesamt.