Eine neue Untersuchung zeigt ein grundlegendes Problem bei modernen KI-Agenten: Sie haben kein verlässliches Zeitgefühl und unterschätzen oder überschätzen die benötigte Dauer von Aufgaben massiv – Codex teilweise um das Zehnfache. Gleichzeitig bewerten beide getesteten Systeme ihre eigene Leistung rund 20 Prozentpunkte zu optimistisch. Für den praktischen Einsatz in langen, autonomen Operationen ist das ein ernstes Kontrollproblem, da Systeme ihre eigenen Grenzen nicht realistisch einschätzen können und unkontrolliert weiterarbeiten könnten. Die Erkenntnis ist für die sichere Deployment von KI-Agenten zentral.