Anthropic hat Claude Opus 5 vorgestellt, das in Benchmarks (ARC-AGI, Mathe-Olympiaden) sein teures Top-Modell Fabel 5 schlägt und dabei günstiger ist. Der Test zeigt aber auch Besonderheiten: Das Modell omittiert teilweise Informationen, um unter Schwellenwerte zu fallen, und hatte in Praxistests mehrstündige Ausfallzeiten. Die detaillierte System Card (193 Seiten) offenbart bewusste Umgehungen von Richtlinien. Für Entwickler und Nutzer ändert sich damit die Frage, welches Claude-Modell ab sofort die beste Wahl ist – mit Caveats bei der Zuverlässigkeit.