395 Artikel · 2026-07
Agenten & Tool-Use Claude wird besser – aber bei der Tool-Nutzung schlechter

Neuere Claude-Modelle erfinden beim Aufrufen von Edit-Tools plötzlich nicht vorgesehene Felder, während ältere Versionen das nicht tun – ein überraschender Trade-off der KI-Verbesserung.

04.07.2026 · Simon Willison
Frontier-Modelle Prompting-Tipps für Claude 3.5: Zuerst die eigenen Wissenslücken aufdecken

Ein Anthropic-Entwickler zeigt, wie Programmierer ihre unbewussten Wissenslücken systematisch aufdecken können, bevor sie Claude mit der Umsetzung beauftragen – denn nicht mehr das Modell, sondern der Nutzer ist der Engpass.

04.07.2026 · The Decoder (DE)
Agenten & Tool-Use Unsichtbare Agenten statt Apps: OpenAI-Chef Brockman skizziert ChatGPT-Zukunft

Greg Brockman erklärt, warum ChatGPT-Plugins scheiterten, und sieht die Zukunft in autonomen, kontextbewussten Agenten ohne sichtbares Interface.

04.07.2026 · The Decoder (DE)
Policy & Ethik KI-Hausaufgaben führen zu Lernverlusten in Prüfungen

Große chinesische Studie zeigt: Schüler mit generativer KI bei Hausaufgaben erledigen diese schneller, schneiden aber in Klausuren bis zu 24 Prozent schlechter ab.

04.07.2026 · The Decoder (DE)
Frontier-Modelle Anthropic wagt Sprung in die Pharmaforschung: KI gegen vernachlässigte Krankheiten

Anthropic entwickelt mit Claude eigene Wirkstoffe gegen Krankheiten, die für Pharmakonzerne wirtschaftlich unrentabel sind – und könnte damit Entwicklungszeit und Erfolgsquoten massiv verbessern.

04.07.2026 · The Decoder (DE)
Coding-Modelle Mistral veröffentlicht Leanstral: KI für formale Mathematik und Code-Verifikation

Mistral AI bringt ein Open-Source-Modell für formale Verifikation in Lean 4 und findet dabei unbekannte Bugs in echtem Code.

04.07.2026 · The Decoder (DE)
Infrastruktur Open-Source-KI: Neue Gap Map zeigt den Stand des Ökosystems

Current AI, eine neu gegründete Non-Profit-Initiative mit 400 Millionen Dollar Kapital, veröffentlicht eine umfassende Karte des Open-Source-KI-Ökosystems mit über 421 detailliert erfassten Produkten.

03.07.2026 · Simon Willison
Produkt-Launch Kurs-Umsätze brechen weg: KI-Tutoren verdrängen Online-Lehre

Ein renommierter Web-Developer-Kurs-Anbieter berichtet von einem dramatischen Einbruch seiner Verkaufszahlen und führt das auf AI-gestützte Tutoren und Jobangst zurück – ein Trend, den mehrere Kurs-Creator bestätigen.

03.07.2026 · Simon Willison
Agenten & Tool-Use Microsoft fusioniert Copilots und bringt KI-Agenten für automatisierte Aufgaben

Im August vereint Microsoft seine Copilot-Apps und führt "AutoPilot"-Agenten ein, die im Hintergrund Aufgaben übernehmen – gegen Gebühr.

03.07.2026 · The Decoder (DE)
Agenten & Tool-Use Fables Urteilskraft: So nutzt man Claude-Code effizienter

Statt Claude Fable detaillierte Anweisungen zu geben, lässt man das Modell besser selbst entscheiden – etwa beim Testen oder beim Delegieren an schwächere Modelle.

03.07.2026 · Simon Willison
Policy & Ethik Claude Code in China: Anthropic gegen Schlupflöcher, Alibaba verbietet das Tool

Anthropic versucht, chinesischen Konzernen den Zugang zu Claude Code zu verweigern – doch Alibaba enthüllt versteckte Code-Routinen zur Nutzer-Identifikation und sperrt das Tool kurzerhand.

03.07.2026 · The Decoder (DE)
Enterprise KI findet dreimal mehr Sicherheitslücken – CVE-Meldungen explodieren

Im Juni 2026 wurden über 1.500 schwere Sicherheitslücken gemeldet – mehr als dreieinhalb Mal so viele wie je zuvor in einem Monat, zeitgleich mit dem Einsatz von KI-gestützten Bug-Hunting-Tools.

03.07.2026 · The Decoder (DE)
Agenten & Tool-Use Britisches KI-Institut: Standard-Benchmarks unterschätzen Agenten-Fähigkeiten massiv

Gängige KI-Bewertungen verschleiern die echten Leistungen von Agenten – der tatsächliche Fortschritt ist deutlich steiler als bisher gemessen.

03.07.2026 · The Decoder (DE)
Agenten & Tool-Use Die fünf Stufen des KI-gestützten Programmierens – und warum Autonomie nicht das Ziel ist

Ein Framework ordnet AI-Coding-Tools vom intelligenten Autocomplete bis zur vollautonomen „Dark Factory" auf fünf Stufen – doch für die meisten ist Level 3 das ideale Ziel, nicht die maximale Autonomie.

03.07.2026 · Cole Medin (YT)
Frontier-Modelle Juni-Newsletter: Claude Fable 5, GPT-5.6 und US-Exportbeschränkungen

Ein monatlicher Überblicks-Newsletter mit Updates zu neuen Modellen, Export-Regulierung und Open-Source-Releases – hauptsächlich für Sponsor:innen zugänglich.

03.07.2026 · Simon Willison
Enterprise KI-Sicherheit in Unternehmen: Webinar zu neuen Angriffsszenarien

Prompt Injection und Data Poisoning erfordern neue Schutzkonzepte, die klassische IT-Sicherheit nicht abdeckt – ein Webinar zeigt, welche Massnahmen Unternehmen jetzt brauchen.

03.07.2026 · The Decoder (DE)
Benchmarks & Evals Der blinde Fleck der Frontier-Modelle: Spezialisiertes Finanz-KI-Modell schlägt GPT und Claude

Bridgewater und Mira Muratis Start-up zeigen mit einem feinabgestimmten Qwen3-Modell, dass spezialisierte KI bei Finanzaufgaben die grossen Frontier-Modelle schlagen kann – bei einem Bruchteil der Kosten.

03.07.2026 · The Decoder (DE)
Agenten & Tool-Use Zuckerberg räumt Probleme bei Metas KI-Agent-Strategie ein

Meta-Chef Zuckerberg gesteht auf internem Townhall ein, dass KI-Agenten – das zentrale Ziel von Metas Konzernumbau – langsamer vorankommen als erhofft.

03.07.2026 · The Decoder (DE)
Enterprise Kling: Chinesische Video-KI sammelt 2 Milliarden Dollar für Börsengang ein

Kuaishous KI-Videoplattform Kling erhält massive Finanzierung und bereitet sich auf den Gang an die Börse vor.

03.07.2026 · The Decoder (DE)
Agenten & Tool-Use AI-Engineer-Konferenz: Die große Schleifen-Debatte und der Stand der KI-Entwicklung

Die AI Engineer World's Fair endete mit einer Debatte über Loops, einem Bericht zum Stand der KI-Entwicklung und Keynotes über künftige Projekte.

03.07.2026 · Latent Space