43 Artikel · 2026-07
Agenten & Tool-Use Cursors Agenten-Schwarm mit Planer-Arbeiter-Architektur schlägt alte Version deutlich

Cursors neue Agenten-Schwarm-Architektur mit getrennten Planer- und Arbeiter-Rollen meistert komplexe Coding-Aufgaben wie SQLite-Neubau in Rust fehlerlos, wo das alte System an Merge-Konflikten scheiterte.

26.07.2026 · The Decoder (DE)
Coding-Modelle Ruff v0.16.0: Python-Linter mit drastisch erweiterten Standardregeln

Astral hat Ruff mit 413 statt 59 Standardregeln ausgestattet – und macht dabei die Arbeit für KI-Agenten leichter.

25.07.2026 · Simon Willison
Benchmarks & Evals Claude Opus 5: Anthropics neues Top-Modell überzeugt bei Performance und Preis

Anthropics Claude Opus 5 führt die KI-Benchmark-Rankings an und unterbietet dabei Konkurrenz-Modelle deutlich im Preis, besonders im Coding- und Analytics-Bereich.

25.07.2026 · The Decoder (DE)
Benchmarks & Evals Kimi K3: Begeisterte Benchmarks, ernüchternde Praxis

Ein praktischer Test zeigt: Das chinesische Spitzenmodell Kimi K3 glänzt zwar in Benchmarks, scheitert in der Realität aber bei anspruchsvollen Engineering-Aufgaben häufiger als geschlossen entwickelte Konkurrenten.

24.07.2026 · Cole Medin (YT)
Coding-Modelle Laguna S 2.1: Poolside zeigt, dass Ausdauer beim Coden wichtiger ist als Größe

Ein neues Coding-Modell des Startups Poolside beweist, dass intelligenteres Verhalten statt mehr Parameter bessere Ergebnisse bringt – sogar bei einem alten Mathe-Problem.

23.07.2026 · The Decoder (DE)
Coding-Modelle Moonshots Kimi K3 erreicht 2,8 Billionen Parameter

Moonshot hat mit Kimi K3 ein riesiges Open-Weight-Modell mit 2,8 Billionen Parametern veröffentlicht – die Frage ist, ob es auch liefert.

22.07.2026 · Fireship Code Report
Coding-Modelle Cisco stellt spezialisierte Open-Source-Modelle für Code-Sicherheit vor

Cisco veröffentlicht zwei kleine, offene KI-Modelle, die Schwachstellen im Code 150-mal kosteneffektiver als große KI-Agenten aufdecken.

22.07.2026 · The Decoder (DE)
Agenten & Tool-Use Anthropic im Gespräch: Wie Claude Code und Claude Tag im täglichen Einsatz funktionieren

Bei der AI Engineer World's Fair erzählten Anthropic-Ingenieure, wie Claude Code und die neue Slack-Integration Claude Tag ihre interne Produktentwicklung transformieren und welche Sicherheits- und Design-Ansätze dahinterstecken.

21.07.2026 · Simon Willison
Agenten & Tool-Use Modell-Fusion statt Modell-Wahl: Das neue Agentic-Engineering-Paradigma

Statt sich für ein KI-Modell zu entscheiden, sollten Entwickler mehrere Modelle kombinieren – eine alte Idee, die nun als „Model Fusion" neu vermarktet wird.

20.07.2026 · IndyDevDan (YT)
Benchmarks & Evals Moonshots Kimi K3 dominiert Frontend-Code, scheitert aber bei komplexer Mathematik

Chinas Kimi K3 schlägt Claude und GPT beim Code-Schreiben, zeigt aber massive Schwächen bei mathematischen Problemen.

19.07.2026 · The Decoder (DE)
Agenten & Tool-Use GPT-5.6: Kritischer Bug löscht versehentlich Benutzerverzeichnisse

OpenAI untersucht Berichte über unerwartete Dateilöschungen in GPT-5.6, wenn Codex ohne Sandbox-Schutz läuft und die $HOME-Variable überschrieben wird.

16.07.2026 · Simon Willison
Coding-Modelle Wie Codex zu OpenAIs kreativem Werkzeug wurde

OpenAIs internes Creative Team nutzt Codex zur Entwicklung eigener KI-Tools, schnelleren Ideenfindung und prototyping mit kontextbewusstem KI-Support.

16.07.2026 · OpenAI Blog
Coding-Modelle xAI öffnet Grok Build: Von Datenchaos zur Open-Source-Reaktion

Nach einem Datenschutz-Skandal, bei dem das Grok-Build-Tool ganze Verzeichnisse ohne Zustimmung hochlud, hat xAI den kompletten Quellcode unter Apache 2.0 freigegeben.

15.07.2026 · Simon Willison
Coding-Modelle Codex gewinnt rasant an Nutzer

Codex fügt täglich eine Million neue Nutzer hinzu und wächst damit exponentiell.

14.07.2026 · Latent Space
Coding-Modelle Codex wächst rasant auf 7 Millionen Nutzer – könnte das Claude Code überholt haben?

OpenAIs Codex-Nutzung ist in sechs Monaten um mehr als das Zehnfache auf 7 Millionen Nutzer angewachsen, doch die Vergleichszahlen zu Anthropics Claude Code bleiben nebulös.

14.07.2026 · Latent Space
Coding-Modelle DOOMQL: Ein Spiel, das von SQLite gesteuert wird

Ein Entwickler hat ein funktionierendes Doom-ähnliches Spiel gebaut, bei dem SQLite nicht nur Daten speichert, sondern als Game Engine dient – Bewegung, Kollisionen, Grafik, alles läuft über SQL-Queries.

13.07.2026 · Simon Willison
Agenten & Tool-Use KI-Modelle beschleunigen Open-Source-Entwicklung: Ein Anschauungsbeispiel

Ein Entwickler zeigt anhand seiner GitHub-Aktivitäten, wie neuere KI-Modelle wie Opus 4.8 und GPT-5.5 die Produktivität beim Programmieren messbar steigern.

13.07.2026 · Simon Willison
Agenten & Tool-Use Agentic Engineering: Warum „Loop Engineering" der falsche Ansatz ist

Entwickler, die die KI-Industrie dominieren, bauen keine Loops – sie konstruieren AI-Developer-Workflows als Software-Fabriken mit Agenten, Code und menschlicher Überwachung.

13.07.2026 · IndyDevDan (YT)
Agenten & Tool-Use Cactus Needle – Kompaktes 26-Millionen-Parameter-Modell für Function Calling

Ein deutlich kleineres Modell mit innovativer Architektur überzeugt bei Funktionsaufrufen gegen vielfach größere Konkurrenten.

12.07.2026 · Sam Witteveen (YT)
Coding-Modelle Grok 4.5 in der EU blockiert – so funktioniert der Workaround

Elon Musks neues KI-Modell Grok 4.5 ist in Europa gesperrt, lässt sich aber über Umwege nutzen – ein Video zeigt die Sperre live und demonstriert die Leistung beim Coden.

11.07.2026 · IchBinFabian (YT)