Das Forschungsinstitut METR hat mit dem „Expenditure Horizon" eine Metrik entwickelt, die misst, wie kosteneffektiv KI-Agenten Probleme lösen und wann menschliche Entwickler wirtschaftlicher werden. Bei ersten Tests am NanoGPT-Speedrun fallen die Ergebnisse nüchtern aus – KI-Agenten bewältigen die Aufgaben noch nicht wirtschaftlicher als Menschen. Allerdings hat die Kennzahl blinde Flecken, und neue Modellgenerationen könnten diese Rechnung grundlegend verändern. Das Thema berührt eine zentrale Frage der KI-Transformation: Wann werden autonome Systeme tatsächlich kostengünstiger als menschliche Arbeit?