234 Artikel · 2026-08
Dev-Tools Shieldstral: Mistrals kompaktes Sicherheitsmodell schlägt größere Konkurrenten

Mistrals neues 3B-Modell Shieldstral überprüft KI-Ausgaben auf Sicherheitsrisiken und erreicht dabei die Leistung von siebenmal größeren Modellen – mit mehr Flexibilität und lokalem Betrieb.

05.08.2026 · The Decoder (DE)
Benchmarks & Evals Kimi K3 gegen Claude Opus 5: Wer findet die versteckten Bugs im Code?

Ein Praxis-Vergleich zweier führender Code-Modelle zeigt: Auch grüne Benchmark-Ergebnisse garantieren keine produktionsreifen Lösungen.

05.08.2026 · IchBinFabian (YT)
Frontier-Modelle Black Forest Labs stellt FLUX 3 Video vor – mit Audio und Lippensynchron

Black Forest Labs veröffentlicht FLUX 3 Video: ein Modell für 20-sekündige Full-HD-Videos mit nativem Audio, lippensynchronen Dialogen in 14 Sprachen und gerenderter Typografie – und übertrumpft damit laut eigenen Rankings Gemini Omni Flash und Seedance 2.0.

05.08.2026 · The Decoder (DE)
Frontier-Modelle Google Gemini Robotics: Wenn Roboter lernen, wie Menschen denken

Google trainiert humanoidale Roboter mit einem einzigen KI-Modell und veröffentlicht die Reasoning-Komponente als API – die Steuerung bleibt unter Verschluss.

05.08.2026 · The Sequence
Dev-Tools MiniMax-H3 auf Apple Silicon: Text-to-Video jetzt auf dem MacBook

Ein MLX-Port ermöglicht es, das multimodale Video-Generierungsmodell MiniMax-H3 direkt auf Apple-Chips auszuführen – erste Ergebnisse sind beeindruckend, erfordern aber Geduld.

04.08.2026 · Simon Willison
Dev-Tools MiniMax-H3 auf Apple Silicon: Omni-Modal-Video-Generierung im Hands-on Test

MiniMax' neues H3-Modell erzeugt 15-Sekunden-Videoclips aus Text, Bildern, Audio und Video – und läuft jetzt über MLX auch auf M-Series-MacBooks.

04.08.2026 · Simon Willison
Frontier-Modelle OpenAI führt neue Schutzmaßnahmen für Cybersecurity-Tests ein

OpenAI reagiert auf Sicherheitsvorfälle bei Drittanbieter-Evaluationen mit neuen Richtlinien für sichere KI-Modell-Tests.

04.08.2026 · OpenAI Blog
Agenten & Tool-Use ChatGPT Work: Wie OpenAI seinen Agent für eine Milliarde Nutzer baut

Detaillierte Analyse der neuen Features von ChatGPT Work – Memory, Scheduling, Browser-Zugriff, Plugins und Skills im Überblick.

04.08.2026 · Latent Space
Dev-Tools Pulitzer-Preise 2026: Rekord bei KI-Einsatz im Journalismus

So viele Pulitzer-Preisträger wie nie zuvor haben KI-Tools bei ihren prämierten Arbeiten eingesetzt – eine Zäsur für die Medienbranche.

04.08.2026 · The Decoder (DE)
Agenten & Tool-Use Lokale Agents überall mit LFM2.5-2.6B deployen

Ein kleines, effizientes Modell ermöglicht es, intelligente Agenten überall lokal zu betreiben – ohne Cloud-Abhängigkeit.

04.08.2026 · HuggingFace Blog
Frontier-Modelle Durchbruch oder Hype? KI löst mathematische Probleme – aber wer überprüft das?

OpenAI's Astra soll zehn lange offene mathematische Probleme formal beweisen, doch Experten zweifeln an der Validierbarkeit der Lösungen.

04.08.2026 · AI Daily Brief (YT)
Frontier-Modelle Machtkampf im Silicon Valley: USA verschieben Verbote für chinesische KI-Modelle

Trump-Regierung wollte chinesische Open-Weight-Modelle sperren, aber Tech-Giganten wie Nvidia, Google und Meta blockierten – während OpenAI und Anthropic für Beschränkungen warben.

04.08.2026 · The Decoder (DE)
Coding-Modelle Qwen 3.8 Max und neue Open-Source-Modelle: Alibaba greift nach den besten Codierer-KI

Alibabas Qwen-Familie erhält neue Frontier-Modelle mit bis zu 2,4 Billionen Token und spezialisierte Open-Weights-Varianten für Programmierung und Zusammenarbeit.

04.08.2026 · Latent Space
Benchmarks & Evals Open-Source-KI zieht davon

Qwen3.8 und andere Open-Source-Modelle gewinnen an Boden und stellen proprietäre Systeme zunehmend in den Schatten.

04.08.2026 · Matthew Berman (YT)
Agenten & Tool-Use Steve Yegge über KI-Agenten: Wenn Claude Opus sich selbst zerlegt

Yegge beschreibt, wie sein KI-Agent-Projekt „Gas Town" mit Claude Opus 4.7 kollabierte – weil das Modell sich immer wieder selbst optimieren wollte, statt ein stabiles Werkzeug zu bauen.

04.08.2026 · Simon Willison
Agenten & Tool-Use Steve Yegge über die Grenzen von Coding-Agenten: Was schiefging bei Claude Opus 4.7

Der erfahrene Engineer Steve Yegge beschreibt, wie sein selbstbauendes KI-Projekt „Gas Town" mit Claude Opus 4.7 scheiterte, weil das Modell in eine Endlosschleife des Selbst-Optimierens verfiel.

04.08.2026 · Simon Willison
Frontier-Modelle Alibabas Qwen 3.8: KI als Ticket zu mehr Freizeit statt Jobverlust-Angst

Alibaba bewirbt sein neues Modell Qwen 3.8 mit positiver Rahmung: KI übernimmt die Arbeit, Menschen haben mehr Zeit für Hobbys – ein bewusster Gegenpol zur Angst-Rhetorik westlicher KI-Anbieter.

03.08.2026 · The Decoder (DE)
Frontier-Modelle MiniMax H3: Erstes Open-Source-Videomodell führt Rankings an

MiniMax hat sein Videomodell H3 als Open Source freigegeben und setzt sich damit erstmals mit einem offenen Modell an die Spitze von Video-Editing-Rankings.

03.08.2026 · The Decoder (DE)
Coding-Modelle Karpathy testet KI-Grenzen: Kann Claude eine Mittelerde-Szene coden?

OpenAI-Mitgründer Andrej Karpathy nutzt Claude Opus 5 für seine neuen „Vibe-Tests": Herr-der-Ringe-Text rein, Browser-3D-Szene raus – ein cleverer Check für echte KI-Fähigkeiten.

03.08.2026 · The Decoder (DE)
Frontier-Modelle KI löst Krypto-Problem gleichzeitig – zweimal unabhängig

Zwei Forscherteams lösen dasselbe offene quantenkryptografische Problem im Abstand von drei Stunden mit demselben KI-Modell – und stellen damit die Frage nach wissenschaftlicher Originalität neu.

03.08.2026 · The Decoder (DE)