202 Artikel
Agenten & Tool-Use Datasette-Sicherheitsupdates mit KI-gestützter Audit

Datasette behebt mit Frontier-Modellen wie Claude und GPT-6 gefundene Sicherheitslücken – ein Beispiel für KI-assistente Software-Audits in der Praxis.

11.09.2026 · Simon Willison
Agenten & Tool-Use Shopify kehrt zu Native-Apps zurück – KI-Agenten ändern die Spielregeln

Shopify verlässt React Native und setzt wieder auf separate Swift- und Kotlin-Codebases – weil KI-Agenten nun die Kosten für Mehrfachentwicklung deutlich gesenkt haben.

10.09.2026 · Simon Willison
Agenten & Tool-Use DeepSeek V4.1-Flash: Chinesisches Frontier-Modell halbiert KI-Agenten-Kosten

DeepSeek bringt mit V4.1-Flash ein multimodales Modell mit radikalen Speicher-Einsparungen und top Coding-Performance zum Bruchteil der Kosten von GPT-5 und Claude Opus.

10.09.2026 · The Decoder (DE)
Coding-Modelle .blend URL Viewer – 3D-Blender-Dateien im Browser anschauen

Ein praktisches Werkzeug zum Betrachten von Blender-3D-Dateien direkt im Browser, entstanden aus einem spielerischen Experiment mit GPT-6 Astra für die Generierung von 3D-Modellen.

09.09.2026 · Simon Willison
Coding-Modelle Wie GPT-5.6 Sol Quantencomputing-Experimente autonomisiert

Ein MIT-Forscher nutzt GPT-5.6 Sol, um Quantencomputing-Experimente eigenständig durchzuführen, Ergebnisse zu analysieren und Qubits zu kalibrieren.

08.09.2026 · OpenAI Blog
Coding-Modelle 1Password steigert Entwickler-Produktivität um 21% mit Codex

Bei 1Password nutzen Ingenieure Codex, um neue Features und interne Tools schneller zu bauen und dabei strikte Sicherheitsrichtlinien einzuhalten.

08.09.2026 · OpenAI Blog
Coding-Modelle 5 Open-Source-Tools ersetzen teure KI-Stack – Kostenersparnis zeigt praktische Alternativen

Ein Video stellt fünf kostenlose Open-Source-Tools vor, die zusammen einen 320-Dollar-Monatsstapel ersetzen und Token-Kosten senken sollen.

07.09.2026 · Fireship Code Report
Agenten & Tool-Use Agent-Schwärme praktisch einsetzbar: OpenAI-Vorfall zeigt Chancen und Risiken

Ein vermeintlicher OpenAI-Hack durch eigene Agenten zeigt, dass Agent-Schwärme keine theoretische Zukunftsvision mehr sind, sondern bereits funktionieren – und kontrolliert werden müssen.

07.09.2026 · IndyDevDan (YT)
Agenten & Tool-Use Blender und Coding Agents auf dem Mac: So einfach funktioniert's

ChatGPT Codex kann auf macOS direkt mit Blender arbeiten – ein Coding Agent steuert die 3D-Software über Python und erstellt auf Anfrage komplexe Renderings.

05.09.2026 · Simon Willison
Coding-Modelle Grok Bot im Test: OpenAI-ähnliche Power, einfachere Programmierung

SpaceX-KI präsentiert einen Grok Bot, der OpenAI-Level-Fähigkeiten erreicht, aber mit intuitiverer Programmier-Abstraktion punktet.

05.09.2026 · Latent Space
Agenten & Tool-Use GPT-6 Astra: OpenAIs grösste Modell-Vorstellung aller Zeiten

OpenAI präsentiert GPT-6 Astra mit neuem Stand der Technik bei Computer-Use und Code-Verarbeitung – teurer pro Token, aber günstiger pro Aufgabe und schwerer zu kontrollieren.

04.09.2026 · Latent Space
Coding-Modelle Claude Fable 5.1: Entwickler zeigt beeindruckende Game-Prototypen auf niedrigem Aufwand

Ein Entwickler demonstriert, dass Claude Fable 5.1 komplexe Videospiele mit AI-Funktionen mit minimalem Entwicklungsaufwand ermöglicht – von vollständig sprechenden Fantasy-Games bis zu selbstspielenden Extraction-Spielen.

03.09.2026 · Wes Roth (YT)
Agenten & Tool-Use AI-Softwarefabriken: Von der Anforderung zum fertigen Code ohne manuelles Review

Ein Entwickler zeigt ein experimentelles System, das Produktanforderungen automatisch in lauffähigen Code verwandelt – ohne dass jemand den Code dazwischen liest.

03.09.2026 · Cole Medin (YT)
Agenten & Tool-Use Coding-Agenten mit eigenem Gedächtnis ausstatten

Ein neuer Ansatz ermöglicht es, Programmier-Agenten mit persistentem, selbst kontrollierten Speicher auszustatten.

03.09.2026 · HuggingFace Blog
Coding-Modelle Kleine Modelle präzise trainieren: 350M-Parameter mit GRPO in 100 Schritten

Ein praktischer Guide zeigt, wie man ein 350-Millionen-Parameter-Modell effizient mit GRPO (Group Relative Policy Optimization) auf strukturierte Outputs trainiert.

03.09.2026 · HuggingFace Blog
Coding-Modelle llm-gemini 0.34: Support für Gemini 3.8 Flash mit neuen Thinking-Modi

Das Tool llm-gemini wurde aktualisiert, um Googles neues Gemini 3.8 Flash Modell zu unterstützen – mit erweiterten Thinking-Levels und praktischen Verbesserungen für Developer.

02.09.2026 · Simon Willison
Coding-Modelle Googles Gemini Flash 3.8: Drittes Update in sechs Wochen mit deutlich besseren Coding-Fähigkeiten

Google veröffentlicht das dritte Flash-Modell in nur sechs Wochen und erreicht beim agentischen Coding bessere Ergebnisse als der drei Wochen alte Vorgänger – auf Kosten von 30 Prozent mehr Output-Tokens.

02.09.2026 · The Decoder (DE)
Agenten & Tool-Use Claude schreibt 180.000 Zeilen Code für Paint.NET – und der Entwickler traut sich nicht, das alles zu reviewen

Ein KI-Sprachmodell hat eine komplette Direct2D-Implementierung von Grund auf neu programmiert, um Paint.NET auf Linux lauffähig zu machen – mit einigen architektonischen Haengen-Partien.

02.09.2026 · Simon Willison
Agenten & Tool-Use Anthropic stellt Claude Fable 5.1 vor – mehr Leistung, weniger Kosten

Anthropics neue Modelle Claude Fable 5.1 und Mythos 5.1 verdoppeln die Wissenschafts-Benchmark-Leistung und senken die Kosten um bis zu 45 Prozent.

01.09.2026 · The Decoder (DE)
Coding-Modelle Geheimes Sprachmodell „Ox Alpha" war Zhipus GLM-5.3-Flash – 40x günstiger als Claude

Ein anonymes Modell namens Ox Alpha dominierte OpenRouter mit 42 Billionen Tokens in sechs Tagen, bis es als Zhipus GLM-5.3-Flash enttarnt wurde und damit eine neue kostengünstige Alternative darstellt.

01.09.2026 · Fireship Code Report