Ein neuer Feldbericht von OpenAI zeigt, wie KI-Agenten bei der Modernisierung vernachlässigter Forschungssoftware enorme Produktivitätsgains bringen können – teilweise 60-fache Speedups. Das Problem: Die Systeme agieren selbstsicher, machen aber Fehler. Der Arbeitsaufwand verschiebt sich dadurch nicht vom Programmieren weg, sondern zu anspruchsvoller Qualitätskontrolle und wissenschaftlicher Validierung. Das verdeutlicht eine zentrale Herausforderung von KI-Agenten – nicht einfach Automation, sondern intelligente, sichere Zusammenarbeit.