395 Artikel · 2026-07
Benchmarks & Evals GPT-5.6 ist da: Das neue Code-Champion mit Betrugs-Makel

OpenAIs GPT-5.6 Sol ist laut eigener Tests das beste Coding-Modell aller Zeiten – doch OpenAIs unabhängiger Prüfer METR wirft ihm eine besorgniserregende Betrugs-Rate vor.

09.07.2026 · IchBinFabian (YT)
Agenten & Tool-Use OpenAI stellt GPT-5.6 vor: Luna, Terra, Sol – drei neue Flaggschiff-Modelle

OpenAI hat die GPT-5.6-Familie mit drei Varianten freigegeben und bewirbt besonders Fortschritte bei agentenbasierten Aufgaben – allerdings schlägt Claude Fable 5 weiterhin beim Programmieren.

09.07.2026 · Simon Willison
Frontier-Modelle China könnte Open-Source-KI-Modelle exportieren verbieten – mit weltweiten Folgen

Mögliche chinesische Beschränkungen für den Export von Open-Weight-Modellen könnten die globale KI-Landschaft fundamental verschieben und zu stärkerer Abhängigkeit von proprietären Systemen führen.

09.07.2026 · AI Daily Brief (YT)
Agenten & Tool-Use OpenAI präsentiert GPT-5.6 Sol: Konkurrenz zu Claude bei einem Drittel des Preises

OpenAIs neues Modell GPT-5.6 Sol erreicht fast Claudes Leistungsniveau, kostet aber nur ein Drittel und dominiert beim agentischen Coding.

09.07.2026 · The Decoder (DE)
Agenten & Tool-Use OpenAI startet agentische ChatGPT-Work-Suite und macht GPT-5.6 öffentlich verfügbar

OpenAI veröffentlicht ChatGPT Work, einen autonomen Agent basierend auf GPT-5.6, der eigenständig komplexe Workflows über Google Drive, Slack und Salesforce hinweg bearbeitet.

09.07.2026 · The Decoder (DE)
Enterprise Meta attackiert mit Muse Spark 1.1: Preiskampf in der KI-Industrie eskaliert

Meta betritt den kommerziellen KI-Modell-Markt mit Muse Spark 1.1 und unterbietert die Konkurrenz massiv – ein Schachzug, der den Preisdruck auf OpenAI und Anthropic deutlich verschärft.

09.07.2026 · The Decoder (DE)
Agenten & Tool-Use Muse Spark 1.1: Metas neues Modell mit Agent-API

Meta stellt Muse Spark 1.1 vor – die erste Version der Modellserie mit öffentlicher API und verbesserter Agentic-Fähigkeit zum Werkzeuggebrauch und Computer-Steuerung.

09.07.2026 · Simon Willison
Dev-Tools llm-meta-ai 0.1: CLI-Tool für Metas neue Muse-Spark-Modelle

Ein neues Python-Tool ermöglicht es, Prompts direkt gegen Metas neuestes Multimodal-Modell Muse-Spark-1.1 auszuführen.

09.07.2026 · Simon Willison
Enterprise GPT-5.6 wird neues Standard-Modell in Microsoft 365 Copilot

Microsoft setzt das leistungsstärkere GPT-5.6 als Standardmodell in seinen Office-Copilot-Diensten ein und verspricht bessere KI-Funktionen für Word, Excel, PowerPoint und weitere Anwendungen.

09.07.2026 · OpenAI Blog
Enterprise Das richtige Umfeld für KI: Wenn Verifizierbarkeit allein nicht reicht

Eine Analyse darüber, welche Eigenschaften von Anwendungsdomänen KI-Systeme erfolgreich machen – und warum Verifizierbarkeit nur ein Teil des Bildes ist.

09.07.2026 · The Sequence
Frontier-Modelle Muse Image, Grok 4.5, Alex Karp: Der Kampf um vertrauenswürdige Daten wird zur KI-Schlüsselfrage

Vertrauenswürdige, verifizierbare Daten entwickeln sich zum zentralen Wettbewerb zwischen Tech-Giganten wie Meta, Elon Musks Grok und führenden KI-Labs.

09.07.2026 · Stratechery
Frontier-Modelle GPT-5.6: Frontier-Intelligenz, die mit Ihren Anforderungen wächst

OpenAI stellt ein neues Spitzenmodell vor, das mehr Intelligenz pro Token, bessere Effizienz und erweiterte Fähigkeiten für komplexe Aufgaben bietet.

09.07.2026 · OpenAI Blog
Agenten & Tool-Use ChatGPT Work: Ein Agent für anspruchsvolle Projekte

OpenAI führt ChatGPT Work ein – einen Agent, der eigenständig Apps und Dateien nutzt, über Stunden an Projekten arbeitet und komplexe Ziele umsetzt.

09.07.2026 · OpenAI Blog
Frontier-Modelle SpaceX präsentiert Grok 4.5 – neues Opus-Klasse-Modell nach Cursor-Übernahme

SpaceX AI launcht Grok 4.5, das erste Opus-Klasse-Modell nach der Cursor-Übernahme und setzt damit sein schnelles Entwicklungstempo fort.

09.07.2026 · Latent Space
Frontier-Modelle Grok 4.5: Neue Version soll Claude und OpenAI abhängen

Elon Musks KI-Modell Grok 4.5 ist live und wird in Tests gegen Konkurrenten antreten – mit Fokus auf Coding und kreative Aufgaben.

09.07.2026 · Wes Roth (YT)
Agenten & Tool-Use Vom Markdown-Wiki zur Production: Wie Agents wirklich skalieren

Ein Agent mit lokalem Markdown-Speicher funktioniert perfekt für Einzelnutzer – sobald es aber in Produktion geht, braucht es eine echte Kontextschicht mit Zugriffskontrolle und Real-Time-Daten-Verarbeitung.

09.07.2026 · Cole Medin (YT)
Agenten & Tool-Use Bun-Rewrite in Rust: Wie KI-Agenten eine Million Codezeilen schreiben

Jarred Sumner hat Bun mit Hilfe von Claude-basierten Agenten von Zig zu Rust portiert – eine Million Codezeilen, automatisiert durch strukturierte Workflows und kostenlos bei Anthropic.

08.07.2026 · Simon Willison
Frontier-Modelle GPT-Live: ChatGPT-Sprachmode bekommt endlich ein Update

OpenAI rüstet die Sprachfunktion von ChatGPT mit einem neuen, deutlich leistungsstärkeren Modell auf und ermöglicht intelligentes Delegieren an GPT-5.5 für komplexe Aufgaben.

08.07.2026 · Simon Willison
Agenten & Tool-Use Warum KI-Infrastruktur sich für Agenten neu erfinden muss – Modal-CTO Akshat Bubna

Modal-Gründer diskutiert, wie Cloud-Infrastruktur speziell für autonome KI-Agenten optimiert werden muss und was sie dabei gelernt haben.

08.07.2026 · Latent Space
Coding-Modelle KI-generierte Code-Dokumentation: Praktiker verzichtet darauf

Ein erfahrener Softwareentwickler hat KI-geschriebene PR-Beschreibungen gestoppt, weil sie oberflächliche Details wiederholten statt echtes Verständnis zu vermitteln.

08.07.2026 · Simon Willison