OpenAI hat mit GPT Transcribe und GPT Live Transcribe zwei neue Audio-Modelle per API freigegeben, die Fehlerquoten senken und günstiger sind als zuvor. Das ist ein wichtiges Update für OpenAIs Audio-Fähigkeiten, doch in Benchmarks-Tests liegen die neuen Modelle weiterhin hinter etablierten Konkurrenten wie ElevenLabs und Googles Speech-to-Text-Lösung. Der Schritt zeigt OpenAIs Bemühung, in der Spracherkennungs-Landschaft aufzuschließen – ein Bereich, in dem andere Player derzeit dominieren.