211 Artikel
Agenten & Tool-Use Claude wird besser – aber bei der Tool-Nutzung schlechter

Neuere Claude-Modelle erfinden beim Aufrufen von Edit-Tools plötzlich nicht vorgesehene Felder, während ältere Versionen das nicht tun – ein überraschender Trade-off der KI-Verbesserung.

04.07.2026 · Simon Willison
Agenten & Tool-Use Unsichtbare Agenten statt Apps: OpenAI-Chef Brockman skizziert ChatGPT-Zukunft

Greg Brockman erklärt, warum ChatGPT-Plugins scheiterten, und sieht die Zukunft in autonomen, kontextbewussten Agenten ohne sichtbares Interface.

04.07.2026 · The Decoder (DE)
Agenten & Tool-Use Microsoft fusioniert Copilots und bringt KI-Agenten für automatisierte Aufgaben

Im August vereint Microsoft seine Copilot-Apps und führt "AutoPilot"-Agenten ein, die im Hintergrund Aufgaben übernehmen – gegen Gebühr.

03.07.2026 · The Decoder (DE)
Agenten & Tool-Use Fables Urteilskraft: So nutzt man Claude-Code effizienter

Statt Claude Fable detaillierte Anweisungen zu geben, lässt man das Modell besser selbst entscheiden – etwa beim Testen oder beim Delegieren an schwächere Modelle.

03.07.2026 · Simon Willison
Agenten & Tool-Use Britisches KI-Institut: Standard-Benchmarks unterschätzen Agenten-Fähigkeiten massiv

Gängige KI-Bewertungen verschleiern die echten Leistungen von Agenten – der tatsächliche Fortschritt ist deutlich steiler als bisher gemessen.

03.07.2026 · The Decoder (DE)
Agenten & Tool-Use Die fünf Stufen des KI-gestützten Programmierens – und warum Autonomie nicht das Ziel ist

Ein Framework ordnet AI-Coding-Tools vom intelligenten Autocomplete bis zur vollautonomen „Dark Factory" auf fünf Stufen – doch für die meisten ist Level 3 das ideale Ziel, nicht die maximale Autonomie.

03.07.2026 · Cole Medin (YT)
Agenten & Tool-Use Zuckerberg räumt Probleme bei Metas KI-Agent-Strategie ein

Meta-Chef Zuckerberg gesteht auf internem Townhall ein, dass KI-Agenten – das zentrale Ziel von Metas Konzernumbau – langsamer vorankommen als erhofft.

03.07.2026 · The Decoder (DE)
Agenten & Tool-Use AI-Engineer-Konferenz: Die große Schleifen-Debatte und der Stand der KI-Entwicklung

Die AI Engineer World's Fair endete mit einer Debatte über Loops, einem Bericht zum Stand der KI-Entwicklung und Keynotes über künftige Projekte.

03.07.2026 · Latent Space
Agenten & Tool-Use Warum Agents die neue Softwaregeneration sind – Vercels Vision

Vercel erklärt mit seinem Eve-Framework, warum autonome Agenten Skills, Sandboxes und speziell designte Websites brauchen.

03.07.2026 · Latent Space
Agenten & Tool-Use Die Website der Zukunft baut sich für jeden Besucher selbst zusammen

Adobe experimentiert mit intelligenten Websites, die ihre Inhalte dynamisch basierend auf individuellen Nutzerabsichten zusammenstellen.

02.07.2026 · Latent Space
Agenten & Tool-Use llm-coding-agent 0.1a0: Ein neuer KI-Agent für Softwareentwicklung

Simon Willisons LLM-Framework bekommt einen Coding-Agent, der mit Claude und GPT eigenständig Code schreiben und debuggen kann.

02.07.2026 · Simon Willison
Agenten & Tool-Use DSPy zur Optimierung von SQL-Prompts in Datasette Agent

Praktische Anwendung von DSPy für die systematische Verbesserung von System-Prompts eines Agenten, der SQL-Queries ausführt – mit konkreten Erkenntnissen über Prompt-Design.

02.07.2026 · Simon Willison
Agenten & Tool-Use Verstehen, um teilzunehmen: Das Dilemma der Code-Agenten

Geoffrey Litt warnt vor „kognitiver Schuld" bei der Zusammenarbeit mit KI-Coding-Agenten und argumentiert, dass Entwickler die generierten Änderungen verstehen müssen, um kreativ mitgestalten zu können.

02.07.2026 · Simon Willison
Agenten & Tool-Use Skill Engineering: Warum KI-Agenten menschliche Anleitung brauchen

Ein Plädoyer gegen einfache, automatisierte KI-Systeme: Experte Paul Bakaus erklärt, warum menschliches Urteilsvermögen beim Design von Agenten unverzichtbar bleibt.

02.07.2026 · Latent Space
Agenten & Tool-Use KI-Agenten erledigen viermal mehr professionelle Aufträge – innerhalb weniger Monate

Ein Benchmark zeigt: Spezialisierte KI-Agenten liefern Freiberufler-Projekte in Profiqualität ab und ihre Fähigkeiten sind in nur acht Monaten um das Vierfache gestiegen.

02.07.2026 · The Decoder (DE)
Agenten & Tool-Use AI-Forschung und menschliche Kontrolle: Spannungen beim "Software Factory"-Ansatz

Diskussion über Autoresearch offenbart grundsätzliche Konflikte zwischen autonomen KI-Systemen und der Forderung nach menschlicher Kontrolle und Verständnis.

02.07.2026 · Latent Space
Agenten & Tool-Use Fable 5: Game-Engine-KI wird praktischer und verbindet sich mit Agent-Plattformen

Fable 5 zeigt neue Integrationsmöglichkeiten mit Claude, Cursor und anderen Agents – inklusive Live-Demos von Game-Szenarien und praktischen Use-Cases.

02.07.2026 · Wes Roth (YT)
Agenten & Tool-Use Google standardisiert Wissensformat für KI-Agenten – OKF ist da

Google hat mit dem Open Knowledge Format (OKF) einen offenen Standard veröffentlicht, der Andrej Karpathys LLM-Wiki-Konzept in einfaches Markdown übersetzt, das KI-Agenten sofort verstehen können – ohne RAG-Pipeline oder Vector-Datenbank.

02.07.2026 · Cole Medin (YT)
Agenten & Tool-Use Autoresearch: Wie sich selbstverbessernde Agenten selbst optimieren

Introspection-Mitgründer Roland Gavrilescu erläutert, wie Agenten durch Rückkopplungsschleifen eigenständig lernen und sich verbessern – und warum Menschen dabei unverzichtbar bleiben.

01.07.2026 · Latent Space
Agenten & Tool-Use Wie Cursor KI in Unternehmen deployt – Software-Fabriken mit Agenten

Cursor zeigt, wie spezialistische Teams Organisationen beim Aufbau von AI-Agenten helfen und damit Software-Produktion neu organisieren.

01.07.2026 · Latent Space