24 Artikel · 2026-07
Frontier-Modelle Gemini Robotics 2: Googles KI-Modell steuert Roboter aller Art

Google DeepMind präsentiert Gemini Robotics 2, ein Vision-Language-Action-Modell, das Roboter verschiedenster Bauformen – von Tischgeräten bis zu humanoiden Ganzkörperrobotern – einheitlich steuern kann.

31.07.2026 · The Decoder (DE)
Agenten & Tool-Use Claude Code generiert komplettes Video-Package: Live-Demo mit Higgsfield MCP

Ein Prompt, vier Thumbnails und ein Video-Clip: Claude Code mit Higgsfield-Integration erstellt ein komplettes Visual-Package für YouTube direkt vom Projektordner aus.

30.07.2026 · IchBinFabian (YT)
Frontier-Modelle Google stellt Lyria 3.5 vor: KI-Modell für natürlichere Musikgenerierung mit verbessertem Gesang

Google veröffentlicht Lyria 3.5 und integriert das verbesserte Musikgenerierungsmodell in Google Flow Music mit neuer Editierfunktion für einzelne Song-Abschnitte.

29.07.2026 · The Decoder (DE)
Frontier-Modelle NVIDIA Cosmos-H-Dreams: Echtzeit-Simulation für Operationsroboter

NVIDIA zeigt, wie generative Video-Simulationen chirurgische Roboterarme trainieren und in Echtzeit steuern können.

27.07.2026 · HuggingFace Blog
Frontier-Modelle Sequence Radar #901: Intelligentere Modelle, KI in der physischen Welt und die wachsende KI-Infrastruktur

Opus 5 treibt die KI-Intelligenz voran, Atom-Roboter bringen KI in die physische Welt, und Infrastruktur-, Finanzierungs- und Sicherheitsfragen prägen die Woche.

26.07.2026 · The Sequence
Frontier-Modelle Claude Opus 5 und Genspark SecondBrain Note sind live

Anthropics neues Spitzenmodell Opus 5 und ein KI-gestütztes Notiz-Device von Genspark sind parallel gestartet, dazu neue Benchmark-Ergebnisse und Debatten über KI-Bewusstsein.

24.07.2026 · Wes Roth (YT)
Frontier-Modelle Claude bekommt Sprach-Tools: direkt Mails schreiben, Kalender verwalten per Stimme

Anthropic erweitert Claudes Sprachmodus um direkten Zugriff auf Gmail, Google Calendar und Slack – ein Wettbewerbsvorteil gegenüber OpenAI und Google.

24.07.2026 · The Decoder (DE)
Frontier-Modelle Black Forest Labs stellt FLUX 3 vor – multimodale Modelle schlagen Konkurrenz

Black Forest Labs hat FLUX 3 angekündigt, ein multimodales Modell, das laut eigenen Angaben Sora 2.0, Gemini Omni und Grok Imagine übertreffen soll – mit Video-Action-Robotik-Variante.

24.07.2026 · Latent Space
Frontier-Modelle Flux 3: Black Forest Labs' multimodales Modell für Bild, Video, Audio und Robotik

Black Forest Labs präsentiert mit Flux 3 ein neues Foundation-Modell, das Bilder, Videos und Audio gleichzeitig verarbeitet und Videos mit natürlichem Sound generiert.

23.07.2026 · The Decoder (DE)
Frontier-Modelle Kimi K3: Chinas Mega-Modell im Blindtest gegen Claude und GPT

Moonshot AI stellt Kimi K3 mit 2,8 Billionen Parametern vor – Chinas größtes Open-Weight-Modell tritt gegen westliche Frontier-Modelle an.

23.07.2026 · Julian Ivanov (YT)
Frontier-Modelle Alibabas Qwen-Image-3.0: Bildgenerator mit Text-Rendering und Infografik-Fähigkeiten

Alibaba stellt Qwen-Image-3.0 vor, einen Text-gesteuerten Bildgenerator, der komplexe Layouts mit winzigen, lesbaren Schriftzügen und mehrsprachiger Unterstützung erzeugen kann.

21.07.2026 · The Decoder (DE)
Benchmarks & Evals Alibabas Qwen-Audio-3.0-TTS-Plus führt Text-to-Speech-Ranking an

Alibabas neues TTS-Modell erreicht Top-Platzierung in der Speech Arena Leaderboard mit 16 Sprachen und Stilsteuerung – allerdings mit langsamer Generierungsgeschwindigkeit.

21.07.2026 · The Decoder (DE)
Multimodal "District 9"-Regisseur Blomkamp produziert ersten KI-generierten Spielfilm

Neill Blomkamp hat mit „Nightborne" einen 13-minütigen Sci-Fi-Horrorfilm komplett mit KI-Videogenerierung erstellt und gründete sein eigenes KI-Filmstudio Barley Studios.

20.07.2026 · The Decoder (DE)
Frontier-Modelle Alibaba präsentiert Qwen3.8: Offenes Frontier-Modell mit 2,4 Billionen Parametern

Alibaba kontert Chinas KI-Rennen mit Qwen3.8, einem multimodalen Modell, das laut eigenem Benchmarking nur von Fable 5 geschlagen wird.

19.07.2026 · The Decoder (DE)
Frontier-Modelle Inkling: Thinking Machines Lab präsentiert großes Open-Weights-Modell

Mira Muratis Thinking Machines Lab hat mit Inkling ein multimodales Open-Source-Modell mit 975 Milliarden Parametern veröffentlicht – eine starke Basis für Feinabstimmung, nicht für absolute Leistung.

16.07.2026 · Simon Willison
Dev-Tools Pedalican: Mit KI-Bildern spielerisch Desktop-Pets erstellen

Ein Entwickler zeigt, wie man mit GPT und Bild-Generierung eigene animierte Desktop-Figuren für Codex erschaffen kann – ein unterhaltsames Beispiel für kreative KI-Nutzung.

14.07.2026 · Simon Willison
Frontier-Modelle Google integriert KI-Bildgenerierung in die Suche

Google fügt KI-Bildgenerierung direkt in die Suche ein und erzeugt automatisch Bilder zu Suchanfragen, wenn das Web keine passenden Ergebnisse liefert.

14.07.2026 · The Decoder (DE)
Labs & Industrie Claude antwortet auf Hindi besonders warm, auf Russisch besonders streng: Wie Sprache KI-Verhalten lenkt

Anthropic zeigt in einer neuen Studie, dass Claudes Werte und Tonalität je nach Sprache systematisch variieren – ein Befund mit Konsequenzen für KI-Bias und globale Fairness.

14.07.2026 · The Decoder (DE)
Frontier-Modelle GPT-Live: ChatGPT-Sprachmode bekommt endlich ein Update

OpenAI rüstet die Sprachfunktion von ChatGPT mit einem neuen, deutlich leistungsstärkeren Modell auf und ermöglicht intelligentes Delegieren an GPT-5.5 für komplexe Aufgaben.

08.07.2026 · Simon Willison
Frontier-Modelle OpenAI stellt GPT-Live vor: ChatGPT spricht natürlicher und hört gleichzeitig zu

Mit GPT-Live führt OpenAI Full-Duplex-Sprachkommunikation ein und delegiert komplexe Fragen an GPT-5.5, um die Antwortqualität zu verbessern.

08.07.2026 · The Decoder (DE)