OpenAI hat einen neuen "Ultrafast"-Modus für sein Modell GPT-5.6 Sol vorgestellt, der durch die Integration von Cerebras-Hardware aus der zehn Milliarden Dollar umfassenden Kooperation bis zu 750 Output-Tokens pro Sekunde liefert – eine 14-fache Steigerung gegenüber Standard-Inferenz. Das Unternehmen baut damit eine dreistufige Preisarchitektur auf (Standard, Fast, Ultrafast), die Geschwindigkeit als eigenständiges, bezahltes Produkt-Feature positioniert. Dies zeigt eine strategische Verschiebung, wo Performance-Grade nicht nur technische Varianten sind, sondern direkt monetarisierte Tiers werden – relevant für jeden, der mit großen Language Models produktiv arbeitet.