96 Artikel · 2026-09
Enterprise Claude Fable/Mythos 5.1: Anthropics neues Spitzenmodell mit drastisch günstigerem Prompt-Caching

Anthropic bringt mit Claude 5.1 ein State-of-the-Art-Modell, das Prompt-Caching 75% billiger macht und gleichzeitig 70% mehr Output-Token ermöglicht.

02.09.2026 · Latent Space
Agenten & Tool-Use Gemini lernt intelligentes Video-Sehen: 88 Prozent weniger Token-Verbrauch

Google führt agentische Videoanalyse bei Gemini ein – das Modell wählt nun selbst aus, welche Segmente in welcher Auflösung es untersucht, statt Videos starr durchzuscannen.

02.09.2026 · The Decoder (DE)
Agenten & Tool-Use GPT-6 Astra erreicht kritische Sicherheitsstufe – mit rätselhafter neuer Architektur

OpenAIs Astra-Modell nutzt eine neue „Recurrent Depth"-Technik, die KI-Denkvorgänge im latenten Raum verschleiert statt sie lesbar zu machen – genau wie Sicherheitsforscher vor dem Verlust von Transparenz warnten.

02.09.2026 · Wes Roth (YT)
Agenten & Tool-Use Qwen 3.8 Flash Next mit Hermes Agent: Lokale KI-Agenten um 2x schneller

Ein Entwickler zeigt, wie Qwen 3.8 Flash Next mit dem Hermes Agent in vLLM doppelt so schnell läuft und lokale KI-Agenten auf neue Performance-Höhen bringt.

02.09.2026 · Digital Spaceport (YT)
Agenten & Tool-Use Anthropic stellt Mythos und Fable 5.1 vor

Anthropic hat neue Versionen seiner Claude-Modelle Mythos und Fable 5.1 veröffentlicht, mit gesteigerter Leistung bei Reasoning und Agent-Fähigkeiten.

01.09.2026 · Matthew Berman (YT)
Benchmarks & Evals Claude Fable 5.1: Anthropic setzt neue Benchmarks – und zeichnet bessere Pelikane

Anthropic hat Claude Fable 5.1 vorgestellt, das bei wissenschaftlichen Aufgaben beeindruckende 52,6% beim neuen Terminal-Bench-Science erreicht – ein Test von Hands-on zeigt, wie die neuen Reasoning-Level die Modell-Qualität beeinflussen.

01.09.2026 · Simon Willison
Agenten & Tool-Use Claude Fable 5.1: Anthropic antwortet OpenAIs Astra mit gigantischen Agent-Verbesserungen

Anthropic hat Claude Fable 5.1 und Mythos 5.1 veröffentlicht – deutlich bessere Long-Horizon-Agenten, 4x günstigere Prompt-Cache-Reads und ein direkter Gegenschlag gegen OpenAIs kommende Astra-Ankündigung.

01.09.2026 · Wes Roth (YT)
Benchmarks & Evals BenchMIRT: Was messen LLM-Benchmarks wirklich?

Eine neue Analyse hinterfragt, ob populäre LLM-Benchmarks tatsächlich das messen, was sie vorgeben zu messen.

01.09.2026 · HuggingFace Blog
Agenten & Tool-Use Anthropic stellt Claude Fable 5.1 vor – mehr Leistung, weniger Kosten

Anthropics neue Modelle Claude Fable 5.1 und Mythos 5.1 verdoppeln die Wissenschafts-Benchmark-Leistung und senken die Kosten um bis zu 45 Prozent.

01.09.2026 · The Decoder (DE)
Coding-Modelle Geheimes Sprachmodell „Ox Alpha" war Zhipus GLM-5.3-Flash – 40x günstiger als Claude

Ein anonymes Modell namens Ox Alpha dominierte OpenRouter mit 42 Billionen Tokens in sechs Tagen, bis es als Zhipus GLM-5.3-Flash enttarnt wurde und damit eine neue kostengünstige Alternative darstellt.

01.09.2026 · Fireship Code Report
Frontier-Modelle Google-Deepmind-Chef räumt Rückstand ein – verspricht Rückkehr an die Spitze

Koray Kavukcuoglu gesteht, dass Googles aktuelle Modelle hinter der Frontier liegen, zeigt sich aber zuversichtlich für ein Comeback.

01.09.2026 · The Decoder (DE)
Frontier-Modelle Astra: OpenAIs erstes Modell mit kritischen Cybersecurity-Fähigkeiten

OpenAI stellt Astra vor – das erste Modell, das die Schwelle für kritische Cybersecurity-Fähigkeiten nach dem Preparedness Framework erreicht.

01.09.2026 · OpenAI Blog
Dev-Tools Die wichtigsten destillierten Modelle: Von DistilBERT bis Bonsai 27B

Ein Überblick über schlanke, effiziente KI-Modelle von DistilBERT über Gemini Flash und Llama bis hin zu DeepSeek und PrismML, die trotz geringerer Größe starke Performance bieten.

01.09.2026 · The Sequence
Agenten & Tool-Use Runway-Modell Solaris: KI generiert Software-Oberflächen in Echtzeit

Das Startup Runway präsentiert mit Solaris ein "Interface World Model", das Benutzeroberflächen Frame für Frame generiert statt klassischen Code auszuführen.

01.09.2026 · The Decoder (DE)
Dev-Tools Fal's H3 Max Live: Video schneller erzeugt als man es schauen kann

Mit H3 Max Live können Videos nun schneller generiert werden, als sie anzuschauen sind – eine neue Grenze in der KI-Videogeneration ist gefallen.

01.09.2026 · Latent Space
Agenten & Tool-Use Apple: Mac wird zur KI-Agent-Maschine – Strategie-Wendung für lokale KI

Apple positioniert den Mac neu als private, permanente Basis für KI-Agenten – ein dezentrales System ohne laufende Cloud-Kosten, das sogar OpenAI massiv bestellt.

01.09.2026 · Wes Roth (YT)