193 Artikel · 2026-09
Frontier-Modelle Fable und Mythos 5.1, GLM-5.3-Flash und Qwen 3.8: Neue Modell-Releases im Überblick

Gleich drei neue Frontier-Modelle treten an – Einblick in unterschiedliche technologische Strategien von Entwicklern.

02.09.2026 · The Sequence
Frontier-Modelle World Labs stellt Atlas vor: Weltmodell für 3D-Szenen aus wenigen Bildern

World Labs hat mit Atlas ein Weltmodell präsentiert, das aus wenigen Bildern dreidimensionale Szenen rekonstruieren und generieren kann – ein Schritt weg von spezialisierten 3D-Modellen.

02.09.2026 · The Decoder (DE)
Enterprise Fable 5.1: Kontroverse Datenspeicherung aufgehoben

Fable veröffentlicht Version 5.1 und schafft seine umstrittene Datenspeicherungsrichtlinie komplett ab – ein Sieg für Datenschutz-bewusste Nutzer.

02.09.2026 · Stratechery
Enterprise Claude Fable/Mythos 5.1: Anthropics neues Spitzenmodell mit drastisch günstigerem Prompt-Caching

Anthropic bringt mit Claude 5.1 ein State-of-the-Art-Modell, das Prompt-Caching 75% billiger macht und gleichzeitig 70% mehr Output-Token ermöglicht.

02.09.2026 · Latent Space
Agenten & Tool-Use Gemini lernt intelligentes Video-Sehen: 88 Prozent weniger Token-Verbrauch

Google führt agentische Videoanalyse bei Gemini ein – das Modell wählt nun selbst aus, welche Segmente in welcher Auflösung es untersucht, statt Videos starr durchzuscannen.

02.09.2026 · The Decoder (DE)
Agenten & Tool-Use Claude schreibt 180.000 Zeilen Code für Paint.NET – und der Entwickler traut sich nicht, das alles zu reviewen

Ein KI-Sprachmodell hat eine komplette Direct2D-Implementierung von Grund auf neu programmiert, um Paint.NET auf Linux lauffähig zu machen – mit einigen architektonischen Haengen-Partien.

02.09.2026 · Simon Willison
Agenten & Tool-Use GPT-6 Astra erreicht kritische Sicherheitsstufe – mit rätselhafter neuer Architektur

OpenAIs Astra-Modell nutzt eine neue „Recurrent Depth"-Technik, die KI-Denkvorgänge im latenten Raum verschleiert statt sie lesbar zu machen – genau wie Sicherheitsforscher vor dem Verlust von Transparenz warnten.

02.09.2026 · Wes Roth (YT)
Agenten & Tool-Use Qwen 3.8 Flash Next mit Hermes Agent: Lokale KI-Agenten um 2x schneller

Ein Entwickler zeigt, wie Qwen 3.8 Flash Next mit dem Hermes Agent in vLLM doppelt so schnell läuft und lokale KI-Agenten auf neue Performance-Höhen bringt.

02.09.2026 · Digital Spaceport (YT)
Agenten & Tool-Use Anthropic stellt Mythos und Fable 5.1 vor

Anthropic hat neue Versionen seiner Claude-Modelle Mythos und Fable 5.1 veröffentlicht, mit gesteigerter Leistung bei Reasoning und Agent-Fähigkeiten.

01.09.2026 · Matthew Berman (YT)
Benchmarks & Evals Claude Fable 5.1: Anthropic setzt neue Benchmarks – und zeichnet bessere Pelikane

Anthropic hat Claude Fable 5.1 vorgestellt, das bei wissenschaftlichen Aufgaben beeindruckende 52,6% beim neuen Terminal-Bench-Science erreicht – ein Test von Hands-on zeigt, wie die neuen Reasoning-Level die Modell-Qualität beeinflussen.

01.09.2026 · Simon Willison
Agenten & Tool-Use Claude Fable 5.1: Anthropic antwortet OpenAIs Astra mit gigantischen Agent-Verbesserungen

Anthropic hat Claude Fable 5.1 und Mythos 5.1 veröffentlicht – deutlich bessere Long-Horizon-Agenten, 4x günstigere Prompt-Cache-Reads und ein direkter Gegenschlag gegen OpenAIs kommende Astra-Ankündigung.

01.09.2026 · Wes Roth (YT)
Benchmarks & Evals BenchMIRT: Was messen LLM-Benchmarks wirklich?

Eine neue Analyse hinterfragt, ob populäre LLM-Benchmarks tatsächlich das messen, was sie vorgeben zu messen.

01.09.2026 · HuggingFace Blog
Agenten & Tool-Use Anthropic stellt Claude Fable 5.1 vor – mehr Leistung, weniger Kosten

Anthropics neue Modelle Claude Fable 5.1 und Mythos 5.1 verdoppeln die Wissenschafts-Benchmark-Leistung und senken die Kosten um bis zu 45 Prozent.

01.09.2026 · The Decoder (DE)
Enterprise Anthropic öffnet KI-Text-Erkennung: Behörden und Medien können jetzt Claude-Wasserzeichen prüfen

Anthropic stellt eine API bereit, mit der Behörden, Medien und Faktenchecker erkennen können, ob Texte vom KI-Modell Claude stammen – eine regulatorische Reaktion auf EU-AI-Act-Anforderungen.

01.09.2026 · The Decoder (DE)
Dev-Tools ChatGPT-App versteckt LibreOffice – Analyst entdeckt Codex-Runtime

OpenAI bindet heimlich 1,7 GB Abhängigkeiten in die ChatGPT-Desktop-App – darunter Python, Node.js und die komplette LibreOffice-Suite für Dokumentverarbeitung.

01.09.2026 · Simon Willison
Enterprise Wie Unternehmen die nächste KI-Konkurrenz-Welle navigieren

OpenAI sperrt Cursor nach SpaceX-Übernahme: Warum Unternehmens-Unabhängigkeit von Model und Tools jetzt überlebenswichtig wird.

01.09.2026 · AI Daily Brief (YT)
Coding-Modelle Geheimes Sprachmodell „Ox Alpha" war Zhipus GLM-5.3-Flash – 40x günstiger als Claude

Ein anonymes Modell namens Ox Alpha dominierte OpenRouter mit 42 Billionen Tokens in sechs Tagen, bis es als Zhipus GLM-5.3-Flash enttarnt wurde und damit eine neue kostengünstige Alternative darstellt.

01.09.2026 · Fireship Code Report
Agenten & Tool-Use 11 praktische Tipps für zuverlässigere Code-Agenten

Ein Entwickler teilt 11 einfache Tricks, um Code-Agenten verlässlicher und effizienter einzusetzen – von besserer Prompt-Gestaltung bis zur Vermeidung häufiger Fallstricke.

01.09.2026 · Cole Medin (YT)
Dwarf-Fortress-Macher rechnet mit KI-Hype in der Spieleindustrie ab

Der Co-Creator von Dwarf Fortress kritisiert den leichtfertigen Umgang mit KI-Hype in der Gaming-Branche und die damit verbundenen Massenentlassungen.

01.09.2026 · Simon Willison
Agenten & Tool-Use Wie KI-native Unternehmen Workflows in Betriebsfähigkeit umwandeln

Startups wie Basis, Clay und Exa Labs nutzen KI-Agenten zur Automatisierung von Onboarding, Account-Management und Developer-Integrationen – praktische Lektionen für Enterprise-Leader.

01.09.2026 · OpenAI Blog