114 Artikel
Coding-Modelle asyncinject 0.7: Dependency Injection für Python – mit Claude als Debugger

Ein Update für eine Utility-Library mit async-Unterstützung, bei dem Claude Fable 5 proaktiv Bugs gefunden und behoben hat.

11.06.2026 · Simon Willison
Coding-Modelle Mit KI-Programmierung zum Schwarzen Loch: Astrophysiker nutzt Codex für Simulationen

Ein Astrophysiker setzt Codex ein, um komplexe Schwarzloch-Simulationen schneller zu bauen und Einsteins Relativitätstheorie zu testen.

11.06.2026 · OpenAI Blog
Benchmarks & Evals Claude Fable 5: Anthropics neues Top-Modell setzt Benchmark-Rekorde – kostet aber doppelt so viel

Anthropic startet die Mythos-Modellklasse mit Claude Fable 5, das fast alle Benchmarks dominiert, aber strengere Sicherheitsfilter und höhere Kosten mit sich bringt.

10.06.2026 · The Decoder (DE)
Agenten & Tool-Use AgentsView: Token-Kosten von KI-Agenten lokal tracken

Ein Developer zeigt, wie man in AgentsView custom Preise für neue Modelle wie Claude Fable 5 setzt, um Token-Ausgaben von lokalen Coding-Agenten zu analysieren.

09.06.2026 · Simon Willison
Coding-Modelle Anthropic präsentiert Claude Fable 5 und Mythos 5 – Durchbruch bei Code und Wissenschaft

Anthropics neue Modelle Fable 5 und Mythos 5 übertreffen die aktuelle Opus-Generation deutlich, wobei Fable 5 Code-Migrationen um ein Vielfaches beschleunigt und Mythos 5 autonome Medikamentenentwicklung demonstriert.

09.06.2026 · The Decoder (DE)
Coding-Modelle North Mini Code: Coheres erstes Coding-Modell für Entwickler

Cohere stellt North Mini Code vor – sein erstes spezialisiertes Modell für Code-Generierung und Entwickler-Workflows.

09.06.2026 · HuggingFace Blog
Coding-Modelle Wie Nextdoor-Ingenieure mit Codex produktiver entwickeln

Nextdoor nutzt Codex und GPT-5.5, um schwer zu replizierende Bugs zu finden, plattformübergreifend zu entwickeln und sich auf Produktergebnisse zu konzentrieren.

09.06.2026 · OpenAI Blog
Coding-Modelle Was Codex für Notion ermöglicht: KI-gestützte Entwicklung im Praxistest

Notion zeigt, wie man Codex einsetzt, um Spezifikationen im ersten Durchgang zu generieren, KI-Sprachsteuerung ins Web zu bringen und kleine Teams produktiver zu machen.

09.06.2026 · OpenAI Blog
Benchmarks & Evals FrontierCode: Benchmarking für Code-Qualität statt Pfusch

Ein neues Benchmarking-Tool soll helfen, die tatsächliche Code-Qualität von KI-Modellen zu messen statt oberflächliche Metriken zu verfolgen.

09.06.2026 · Latent Space
Agenten & Tool-Use Cloudflares KI-Code-Review-Fabrik: Meisterklasse in Agentic Engineering

Cloudflare führt 130.000 KI-Code-Reviews für je einen Dollar durch – ein Lehrstück in Tokenomics und Multi-Agent-Orchestrierung.

08.06.2026 · IndyDevDan (YT)
Agenten & Tool-Use Gemma 4 lokal: KI-Agent gratis und offline auf dem eigenen Rechner

Ein vollständiger KI-Agent läuft dank Gemma 4 12B und Ollama kostenlos und datenschutzkonform offline auf dem eigenen Computer – ehrlicher Hands-On-Test inklusive Hardware-Grenzen.

07.06.2026 · IchBinFabian (YT)
Coding-Modelle Elon Musks xAI trainierte heimlich mit Anthropics Claude-Modellen

xAI soll monatelang Anthropics Claude destilliert und nach der Blockade über Umwege weiter genutzt haben – während Musks teure Hardware stattdessen an Anthropic vermietet wird.

06.06.2026 · The Decoder (DE)
Agenten & Tool-Use Alibabas Qwen3.7-Plus: Multimodaler Agent programmiert eigenständig Apps

Alibabas neues Frontier-Modell Qwen3.7-Plus verbindet visuelle Wahrnehmung, Bildschirmbedienung und Code-Generierung in einem agentengestützten System und baute in einer Demo autonom eine App mit über 10.000 Zeilen Code.

06.06.2026 · The Decoder (DE)
Coding-Modelle MiniMax M3: Chinesisches Coding-Modell im ehrlichen Test – billig, aber fehlerhaft

Ein Hands-on-Test mit MiniMax Code und dem neuen M3-Modell aus China offenbart: extrem günstig, aber instabile App und langsame Agent-Modi.

04.06.2026 · IchBinFabian (YT)
Coding-Modelle Opus und Gemini im Team: Die perfekte Arbeitsteilung für Frontend-Entwicklung

Zwei neue Flagship-Modelle, eine Strategie: Opus übernimmt die Planung, Gemini das schöne Design – ein praktisches Workflow-Video zeigt, wie man damit Full-Stack-Apps baut.

04.06.2026 · Cole Medin (YT)
Agenten & Tool-Use Uber bremst KI-Coding-Tools aus – $1.500 Dollar Budget pro Mitarbeiter pro Monat

Der Fahrtdienst-Konzern rationiert seinen Token-Verbrauch: Jeder Mitarbeiter darf maximal $1.500 monatlich pro Coding-Agent wie Claude Code oder Cursor ausgeben – ein deutliches Zeichen für explodierendes KI-Kosten-Management in der Praxis.

03.06.2026 · Simon Willison
Coding-Modelle Wie Wasmer mit Codex einen Node.js-Runtime für Edge-Computing entwickelte

Wasmer nutzte Codex und GPT-5.5, um einen Node.js-Runtime für Edge-Geräte zu bauen und die Entwicklung um 10–20x zu beschleunigen.

03.06.2026 · OpenAI Blog
Coding-Modelle OpenAI verwandelt Codex in eine Allzweck-App mit rollen­spezifischen Plugins

OpenAI baut sein Coding-Tool Codex mit Plugins für Data Analytics, Sales und Investment Banking aus und richtet es verstärkt an Nicht-Entwickler – eine Nutzergruppe, die dreimal schneller wächst.

02.06.2026 · The Decoder (DE)
Agenten & Tool-Use MiniMax M3: Chinesisches Coding-Modell schlägt GPT 4.5 – aber lohnt sich wirklich?

Das neue chinesische Modell MiniMax M3 verspricht überlegene Coding-Performance, 1 Million Token Context und sensationelle Preise – ein Hands-on-Test mit ehrlicher Einordnung.

02.06.2026 · IchBinFabian (YT)
Agenten & Tool-Use Githubs Plan für KI-Agenten: Die nächste Stufe des Copilot-Ökosystems

GitHub legt dar, wie die Plattform mit der wachsenden Welle agentenbasierter KI-Coding-Tools umgehen will – und damit die Zukunft der Developer Experience gestaltet.

02.06.2026 · Latent Space