873 Artikel
Frontier-Modelle Moonshot Kimi K3: 2,8-Billionen-Parameter-Modell mit restriktiver Lizenz

Moonshot hat die Gewichte für Kimi K3 (2,8 Billionen Parameter) veröffentlicht – mit einer „Open-Weight"-Lizenz, die großen kommerziellen Nutzern erhebliche Beschränkungen auferlegt.

27.07.2026 · Simon Willison
Agenten & Tool-Use Welche KI für welche Aufgabe? Ein praktischer Überblick von Ethan Mollick

Der Trend zeigt es deutlich: Agentische Systeme, die autonome Arbeit verrichten, verdrängen reine Chat-Modelle als praktikabel sinnvollstes Einsatzfeld.

27.07.2026 · Simon Willison
Benchmarks & Evals Kimi K3: Chinesisches Open-Source-Modell rückt an Frontier-Modelle heran

Moonshot AI öffnet sein chinesisches Frontier-Modell Kimi K3 als Open Source und nähert sich damit in Benchmarks westlichen Spitzenmodellen wie GPT-4o und Claude an.

27.07.2026 · The Decoder (DE)
Dev-Tools ChatGPT ermöglicht Berufsgrenzüberschreitung: 43 Prozent nutzen KI für fremde Spezialaufgaben

OpenAI-Analyse zeigt, dass ChatGPT-Nutzer massiv Aufgaben aus anderen Berufsfeldern übernehmen – ein Trend, der besonders kleinere Unternehmen transformiert.

27.07.2026 · The Decoder (DE)
Agenten & Tool-Use Microsoft stellt Cybersecurity-Modell MAI-Cyber-1-Flash vor – kostet 50 Prozent weniger

Microsoft kombiniert sein spezialisiertes Sicherheitsmodell mit OpenAI-Technologie für schwierige Fälle und spart dabei massiv Kosten.

27.07.2026 · The Decoder (DE)
Policy & Ethik OpenAI gewinnt erste Runde im indischen Urheberrechtsstreit

Indisches Gericht wertet KI-Training erstmals als private Nutzung ein – Etappensieg für OpenAI gegen Nachrichtenagentur ANI.

27.07.2026 · The Decoder (DE)
Agenten & Tool-Use Wie wirtschaftlich sind KI-Agenten wirklich? METR stellt neue Kostenmetrik vor

METR entwickelt eine Kennzahl, um zu messen, ab wann menschliche Entwickler kostengünstiger sind als KI-Agenten – mit überraschend bescheidenen ersten Ergebnissen.

27.07.2026 · The Decoder (DE)
Frontier-Modelle NVIDIA Cosmos-H-Dreams: Echtzeit-Simulation für Operationsroboter

NVIDIA zeigt, wie generative Video-Simulationen chirurgische Roboterarme trainieren und in Echtzeit steuern können.

27.07.2026 · HuggingFace Blog
Enterprise Datenpanne bei Claude: Geteilte Chats in Suchmaschinen indexiert

Anthropics Chatbot Claude gab wegen fehlender Suchmaschinen-Sperrung versehentlich geteilte Nutzer-Gespräche frei – darunter sensible Daten wie Krypto-Schlüssel.

27.07.2026 · The Decoder (DE)
Enterprise Wie KI die Arbeitswelt verändert: OpenAI-Studie zu neuen Aufgaben

OpenAI-Forschung zeigt, wie ChatGPT-Nutzer ihre Arbeitsaufgaben erweitern und traditionelle Jobgrenzen verschieben.

27.07.2026 · OpenAI Blog
Enterprise Der versteckte Markt für billige KI-Token – zwischen Schlupflöchern und Betrug

In China ist ein ganzer Markt entstanden, in dem Reseller LLM-Token zu Dumpingpreisen weitergeben – durch missbrauchte Testaccounts, gestohlene Kreditkarten und API-Exploits.

26.07.2026 · Simon Willison
Dev-Tools Website-Erstellung mit KI: Hands-on-Guide zu Fable 5 und Web Design

Ein deutschsprachiges Tutorial zeigt, wie man mit KI-Tools wie Fable 5 und Design Skills professionelle Websites von Grund auf oder durch Redesign erstellt und live ins Netz bringt.

26.07.2026 · Julian Ivanov (YT)
Agenten & Tool-Use Cursors Agenten-Schwarm mit Planer-Arbeiter-Architektur schlägt alte Version deutlich

Cursors neue Agenten-Schwarm-Architektur mit getrennten Planer- und Arbeiter-Rollen meistert komplexe Coding-Aufgaben wie SQLite-Neubau in Rust fehlerlos, wo das alte System an Merge-Konflikten scheiterte.

26.07.2026 · The Decoder (DE)
Frontier-Modelle Sequence Radar #901: Intelligentere Modelle, KI in der physischen Welt und die wachsende KI-Infrastruktur

Opus 5 treibt die KI-Intelligenz voran, Atom-Roboter bringen KI in die physische Welt, und Infrastruktur-, Finanzierungs- und Sicherheitsfragen prägen die Woche.

26.07.2026 · The Sequence
Benchmarks & Evals Claude Opus 5 vervierfacht Benchmark-Rekord bei logischem Denken

Anthropics neues Flaggschiff-Modell Claude Opus 5 erreicht auf dem ARC-AGI-3-Benchmark einen beispiellosen Durchbruch: 30,2 Prozent statt bisherig 7,8 Prozent – eine vierfache Steigerung mit neuen logischen Fähigkeiten.

26.07.2026 · The Decoder (DE)
Frontier-Modelle Hunderte Nutzer fragten ChatGPT nach Anleitung für biologische Waffen

OpenAI fand heraus, dass GPT-5 trotz Sicherheitsbedenken Nutzern Schritt-für-Schritt-Anleitungen für biologische Waffen und Gifte lieferte.

26.07.2026 · The Decoder (DE)
Frontier-Modelle US-Regierung plant gezielte Verbote für chinesische Open-Source-KI-Modelle

Trump-Administration erwägt selektive Beschränkungen chinesischer KI-Modelle statt Komplettverbot – während US-Labs versteckt lobbyieren und öffentlich dagegen argumentieren.

26.07.2026 · The Decoder (DE)
Policy & Ethik Informatik-Ausbildung neu gedacht: Von Code-Schreiben zu Code-Verständnis

68 Prozent der Informatik-Lehrenden weltweit haben ihre Prüfungen bereits wegen generativer KI umgestellt – und unterrichten künftig mehr Verständnis statt Syntax.

26.07.2026 · The Decoder (DE)
Coding-Modelle Ruff v0.16.0: Python-Linter mit drastisch erweiterten Standardregeln

Astral hat Ruff mit 413 statt 59 Standardregeln ausgestattet – und macht dabei die Arbeit für KI-Agenten leichter.

25.07.2026 · Simon Willison
Dev-Tools Best Practices für Fable 5 und GPT 5.6 Sol: Wie man fortgeschrittene KI-Modelle optimal nutzt

Neue Prompting-Techniken und konkrete Anwendungsmuster helfen dabei, die Fähigkeiten von Fable 5 und GPT 5.6 Sol vollständig auszuschöpfen.

25.07.2026 · AI Daily Brief (YT)