545 Artikel · 2026-08
Benchmarks & Evals PerceptionBench: Multimodale KI-Modelle bei Bildverständnis deutlich schwächer als vermutet

Ein neuer Benchmark von Moonshot AI zeigt, dass kein Frontier-Modell 60 Prozent Genauigkeit beim reinen Bildlesen erreicht – viele vermeintliche Reasoning-Fehler entstehen bereits beim Sehen.

15.08.2026 · The Decoder (DE)
Dev-Tools KI-Wochenrückblick: ChatGPT Ultrafast, Grok Bot und drei neue Open-Source-Modelle

OpenAI launcht schnellere ChatGPT-Variante, xAI erwirbt Cursor-Editor, und Meta, DeepSeek sowie GLM veröffentlichen neue Frontier-Modelle.

14.08.2026 · Matthew Berman (YT)
Dev-Tools Halluzinationen nutzen: Smarter Tagging mit LLMs und Embeddings

Ein cleverer Trick: LLMs frei Kategorien erfinden lassen, dann mit Embeddings zur echten Taxonomie matchen – ideal für große Tag-Vokabulare.

14.08.2026 · Simon Willison
Policy & Ethik Anthropic bringt Watermarking-API zum Erkennen von Claude-Texten

Anthropic startet eine Prüf-API für Drittanbieter, die KI-generierte Texte von Claude zuverlässig identifiziert – basierend auf Googles SynthID-Technologie.

14.08.2026 · The Decoder (DE)
Frontier-Modelle Qwen 3.8 27B auf lokalen GPUs: Hardware-Setup für lokale KI

Ein Review und praktisches Hands-on zum Betrieb des Qwen-3.8-27B-Modells auf lokaler Hardware mit detailliertem GPU-Setup.

14.08.2026 · Digital Spaceport (YT)
Agenten & Tool-Use Die „KI-Dark-Factory": Wie Agenten jetzt selbst Code schreiben und deployen

Automatisierte Coding-Agenten werden praktikabel: Ein Entwickler zeigt, wie man ein System baut, das Anforderungen automatisch in funktionierenden, getesteten und ausgerollten Code verwandelt.

14.08.2026 · Cole Medin (YT)
Infrastruktur Flock Safety: Wie eine Startup mit KI-Kameras zum Überwachungsnetzwerk wurde

Eine investigative Recherche zur Flock Safety und ihren Edge-ML-Kameras, die ein warrantloses Tracking-Netzwerk ermöglichen – und zum Gegenschlag aus der Open-Source-Community.

14.08.2026 · Fireship Code Report
Enterprise Das CapEx-Karussell dreht sich weiter

Eine Wochenanalyse über die Kapitalbudget-Engpässe in der KI-Industrie, den Stand von KI-gestütztem Schreiben und wirtschaftliche Verschiebungen.

14.08.2026 · Stratechery
Agenten & Tool-Use Alibaba veröffentlicht Qwen3.8 – offene Gewichte, starker bei Code

Qwens neues 27-Milliarden-Parameter-Modell mit Apache-2.0-Lizenz übertrifft größere Konkurrenz in Programmierung und soll Agenten-Entwicklern neue Möglichkeiten eröffnen.

14.08.2026 · The Decoder (DE)
Dev-Tools ChatGPT trackt jetzt deinen Mac-Arbeitsalltag

OpenAI führt „Computer History" ein – eine Funktion, die Klicks, Tastatureingaben und App-Wechsel aufzeichnet und ChatGPT als durchsuchbare Arbeitskontext-Timeline zur Verfügung stellt.

14.08.2026 · The Decoder (DE)
Agenten & Tool-Use Studie widerlegt Autonomie-Versprechen: KI-Agenten scheitern an echter Forschung

Frontier-Modelle können KI-Forschungspapiere zwar technisch verfassen, werden von echten Experten aber durchweg abgelehnt – ihnen fehlt Forschungsurteil und kreative Problemlösung.

14.08.2026 · The Decoder (DE)
Frontier-Modelle OpenAI startet "Ultrafast"-Modus für GPT-5.6 Sol – 14x schnellere Inferenz

OpenAI bringt einen neuen "Ultrafast"-Inferenz-Modus, der dank Cerebras-Hardware bis zu 750 Output-Tokens pro Sekunde erreicht und Geschwindigkeit zum preisstaffeligen Produkt-Feature macht.

14.08.2026 · The Decoder (DE)
Architektur-Innovation Von der Eingabe zum Token: Wie KI-Inference wirklich funktioniert

Ein Überblicks-Guide zu Prefill, Decode, KV-Caches und den Systemen hinter responsiven KI-Produkten.

14.08.2026 · The Sequence
Agenten & Tool-Use Anthropic setzt Claude zur autonomen App-Wartung ein: Fast die Hälfte der KI-generierten Code-Änderungen wird akzeptiert

Anthropic lässt sein eigenes Modell Claude Code automatisch Wartungsaufgaben in seinen Apps übernehmen – mit überraschend hoher Erfolgsquote.

14.08.2026 · The Decoder (DE)
Coding-Modelle Zhipu AI bringt GLM-5.3: Chinas Open-Source-Modell für Code-Sicherheit

Zhipu AI veröffentlicht GLM-5.3 als Open-Weights-Modell mit 50 Prozent besserer Code-Performance und spezialisiert auf Cybersicherheit.

14.08.2026 · The Decoder (DE)
Coding-Modelle SpaceX AI kauft Cursor für 60 Milliarden Dollar

SpaceX Ventures akquiriert das KI-Coding-Tool Cursor in einer der größten Tech-Übernahmen des Jahres.

14.08.2026 · Latent Space
Frontier-Modelle Gemini 3.7 Flash: Googles schnelles Sprachmodell ist zurück

Google reaktiviert mit Gemini 3.7 Flash sein Flaggschiff-Modell für schnelle, effiziente KI-Anwendungen.

14.08.2026 · Latent Space
Frontier-Modelle State of Open Models: Sommerbetrachtung 2026

Eine Analyse des Open-Source-KI-Ökosystems zeigt Verschiebungen in Architektur, Performance und Marktdynamiken der offenen Modelle im Sommer 2026.

14.08.2026 · HuggingFace Blog
Frontier-Modelle Grok 4.6: Der KI-Markt wird konkurrenzfähiger und vielfältiger

Grok 4.6 zeigt, dass KI-Nutzer endlich echte Alternativen zu den Marktführern haben – schneller, günstiger und kompetitiver denn je.

13.08.2026 · AI Daily Brief (YT)
Dev-Tools llm-gemini 0.33: Plugin-Update mit Gemini 3.7 Flash und neuen Embedding-Modellen

Das LLM-Plugin für Google Gemini wird aktualisiert und unterstützt nun das neue Gemini 3.7 Flash-Modell sowie verbesserte Tool- und Reasoning-Funktionen.

13.08.2026 · Simon Willison