12 Artikel · 2026-09
Enterprise GPT-Live-1: Natürliche Sprachgespräche jetzt in der OpenAI-API verfügbar

OpenAI integriert sein Voice-Modell GPT-Live-1 in die API: Echtzeit-Duplexgespräche, bessere Befehlsverständigung, Custom Voices und Telefonie-Support.

10.09.2026 · OpenAI Blog
Frontier-Modelle Suno stellt v6 vor: Neue KI-Musikmodelle mit Majors, alte Versionen verschwinden

Suno launcht drei neue Musikmodell-Varianten in v6, entwickelt mit Warner, BMG und Believe – doch Universal und Sony klagen weiter, während Suno über die Trainingsdaten schweigt.

09.09.2026 · The Decoder (DE)
Frontier-Modelle Woche KI-Updates: Meta Muse Spark, World Labs Atlas und Gemini 3.8 Flash

Drei bedeutende Produktreleases in einer Woche: Meta stellt Muse Spark vor, World Labs zeigt Atlas, Google bringt Gemini 3.8 Flash.

09.09.2026 · The Sequence
Multimodal ChatGPT Images 2.5: Mehr Kontrolle über generierte Bilder

OpenAI stellt ChatGPT Images 2.5 vor, ein Update für bessere Kontrolle über die Bildgenerierung aus Ideen, Skizzen und Referenzfotos.

08.09.2026 · OpenAI Blog
Frontier-Modelle Qwen-Drive-1.0: Alibabas KI-Auto erkennt die Welt, erklärt aber nicht immer warum

Alibabas neues Fahrerassistenz-KI-Modell verbindet Umwelterfassung und Fahrtplanung, doch seine Begründungen für Manöver stimmen nicht immer.

07.09.2026 · The Decoder (DE)
Frontier-Modelle Google liefert hochauflösende stündliche Wettervorhersagen mit KI statt Physik-Modellen

Google Research und DeepMind präsentieren WeatherNext 3: ein KI-Modell, das aus Satellitendaten lernt und Vorhersagen mit 5-km-Auflösung in stündlichen Intervallen liefert – fünfmal detaillierter als der Vorgänger.

06.09.2026 · The Decoder (DE)
Dev-Tools Google integriert KI-Musikgenerierung Lyria 3.5 in Gemini

Google bringt sein Musikgenerierungsmodell Lyria 3.5 direkt in die Gemini-App und API – mit verbessertem Gesang, reicheren Arrangements und Zugang über mehrere Google-Plattformen.

06.09.2026 · The Decoder (DE)
Agenten & Tool-Use Meta stellt Echtzeit-Sprachmodell für ständig zuhörende KI-Assistenten vor

Metas „Muse Voice Transcribe" transkribiert Sprache in Echtzeit mit Sprecher-Unterscheidung und könnte die Basis für Assistenten bilden, die dauerhaft über Kameras wie der Meta-Brille mithören.

06.09.2026 · The Decoder (DE)
Frontier-Modelle OpenAI präsentiert GPT-6 Astra für Entwickler

OpenAI stellt das neue Flaggschiff-Modell GPT-6 Astra vor, das mit verbessertem Prompt-Verständnis und besonders starken Fähigkeiten beim Generieren von 3D-Modellen punktet.

05.09.2026 · Simon Willison
Architektur-Innovation NeoMME: Ein effizienter multimodal-nativer mehrsprachiger Encoder

Ein neues Modell kombiniert Multimodal-Verarbeitung mit nativer Mehrsprachigkeit und optimierter Effizienz für globale Anwendungen.

03.09.2026 · HuggingFace Blog
Dev-Tools Legora sichtet 41 Dokumente in Minuten mit GPT-6 Astra

Ein Finanz-Audit-Workflow zeigt, wie GPT-6 Astra in Minutenschnelle Dokumentenprüfungen bewältigt und dabei versteckte Fehler zuverlässig erkennt.

03.09.2026 · OpenAI Blog
Frontier-Modelle World Labs stellt Atlas vor: Weltmodell für 3D-Szenen aus wenigen Bildern

World Labs hat mit Atlas ein Weltmodell präsentiert, das aus wenigen Bildern dreidimensionale Szenen rekonstruieren und generieren kann – ein Schritt weg von spezialisierten 3D-Modellen.

02.09.2026 · The Decoder (DE)