114 Artikel
Coding-Modelle MicroPython im Browser: WebAssembly-Sandbox für sichere Code-Ausführung

MicroPython läuft jetzt als WebAssembly-Build – eine Sandbox-Lösung für isolierte Python-Code-Ausführung mit Wasmtime.

02.06.2026 · Simon Willison
Coding-Modelle Mellum2: JetBrains stellt kompaktes 12B-Mixture-of-Experts-Modell vor

JetBrains veröffentlicht Mellum2, ein 12-Milliarden-Parameter-Modell mit Mixture-of-Experts-Architektur, das Programmieraufgaben effizient bewältigen soll.

01.06.2026 · HuggingFace Blog
Benchmarks & Evals SWEbench ist abgelöst

Ein bekanntes Benchmark-System für Software-Engineering-KI-Modelle wird als obsolet erklärt – möglicherweise weil neue Systeme es übertroffen haben.

01.06.2026 · Matthew Berman (YT)
Agenten & Tool-Use Pi Coding Agent: So misst man, ob KI-Agenten tatsächlich Wert schaffen

Ein praktisches Framework zeigt, wie man Coding-Agenten wirklich beobachtet und vergleicht – und damit endlich sieht, was sie kosten und ob sie lohnen.

01.06.2026 · IndyDevDan (YT)
Architektur-Innovation MiniMax M3: Open-Weight-Modell mit einer Million Token Kontext und Coding-Fähigkeiten

Das chinesische Unternehmen MiniMax stellt M3 vor – ein offenes Modell, das Coding-Leistungen auf Spitzenniveau mit massivem Kontextfenster, Multimodalität und deutlich besserer Effizienz kombiniert.

01.06.2026 · The Decoder (DE)
Agenten & Tool-Use KI-Agent für 8€ statt 47€ – Hermes + DeepSeek V4 Flash im Kostencheck

Entwickler ersetzt Claude durch Hermes Agent und DeepSeek V4 Flash im Self-Hosting – bei gleicher Leistung 5x günstiger und mit 24/7-Verfügbarkeit.

31.05.2026 · IchBinFabian (YT)
Agenten & Tool-Use Große Gender-Lücke bei KI-Coding-Tools: Männer nutzen Agenten doppelt so häufig

Eine Anthropic-Studie zeigt: Forscher mit männlichen Namen verwenden Coding-Agenten wie Claude Code mehr als doppelt so oft wie Kolleginnen – auch bei gleicher Fachkompetenz.

31.05.2026 · The Decoder (DE)
Coding-Modelle Python-Apps direkt im Browser – mit Pyodide und Service Workers

Entwickler Simon Willison zeigt, wie man Python ASGI-Anwendungen vollständig im Browser via Pyodide und WebAssembly laufen lässt – mit Hilfe von Claude Opus als Coding-Partner.

30.05.2026 · Simon Willison
Agenten & Tool-Use OpenAI bringt Computer Use für Codex auf Windows 11

OpenAIs Codex kann nun eigenständig Windows-Programme steuern, testen und debuggen – eine bedeutende Ausweitung der KI-Fähigkeiten auf lokale Desktops.

30.05.2026 · The Decoder (DE)
Agenten & Tool-Use Salesforce-Entwickler mit Claude Code: 79 Prozent mehr Produktivität – oder nur Marketing?

Salesforce hat seine gesamte Entwicklung auf Anthropics Claude Code umgestellt und berichtet von massiven Produktivitätsgewinnen – doch unabhängige Überprüfung bleibt aus.

30.05.2026 · The Decoder (DE)
Agenten & Tool-Use Claude Opus 4.8: Zuverlässiger coden statt Benchmark-Sprünge

Anthropics neues Flaggschiff-Modell Opus 4.8 glänzt vor allem durch höhere Zuverlässigkeit und Ehrlichkeit beim Code – ein Fokus auf praktische Verbesserungen statt Benchmark-Rekorde.

29.05.2026 · IchBinFabian (YT)
Agenten & Tool-Use Die alljährliche KI-Stagnations-Panik kehrt zurück

DeepSWE-Benchmark offenbart Leistungslücken bei komplexen Coding-Aufgaben, während Tokenknappheit und Finanzierungsdruck das Marktmodell unter Druck setzen.

29.05.2026 · AI Daily Brief (YT)
Coding-Modelle Braintrust nutzt Codex und GPT-5.5 für schnellere Entwicklung

Braintrust-Ingenieure setzen Codex mit GPT-5.5 ein, um Experimente durchzuführen und schneller Code zu schreiben.

29.05.2026 · OpenAI Blog
Coding-Modelle PyTorch profiling für Anfänger: Optimieren mit torch.profiler

Ein praktisches Tutorial zur Performance-Analyse von PyTorch-Modellen mit dem nativen Profiling-Tool torch.profiler.

29.05.2026 · HuggingFace Blog