Der Entwickler Simon Willison hat einen faszinierenden Vergleich gezogen: Dieselbe Text-Prompt zur Erzeugung eines Videospiels wurde zunächst Claude Fable 5 gegeben, dann GPT-5.6 Sol Ultra im aggressiven Multi-Agent-Modus. Das Ergebnis war bemerkenswert – Sol Ultras Version mit Sub-Agents war spielerisch kreativer und näher am Original-Konzept des „Heists". Der Prozess zeigt, wie moderne Frontier-Modelle mit orchestrierten Agenten komplexe Kreativ-Aufgaben bewältigen: Das System koordinierte Code-Generierung, Grafik-Synthese und Debugging selbstständig. Allerdings offenbarte sich auch eine Limitierung – trotz visuellem Review während der Entwicklung übersah Codex einen Rendering-Bug (gigantische Augensphären) – was der Mensch mit zwei einfachen Prompts behob. Die Session dauerte 52 Minuten und hätte knapp 23 Dollar gekostet.