179 Artikel · 2026-07
Frontier-Modelle Moonshot Kimi K3: 2,8-Billionen-Parameter-Modell mit restriktiver Lizenz

Moonshot hat die Gewichte für Kimi K3 (2,8 Billionen Parameter) veröffentlicht – mit einer „Open-Weight"-Lizenz, die großen kommerziellen Nutzern erhebliche Beschränkungen auferlegt.

27.07.2026 · Simon Willison
Agenten & Tool-Use Welche KI für welche Aufgabe? Ein praktischer Überblick von Ethan Mollick

Der Trend zeigt es deutlich: Agentische Systeme, die autonome Arbeit verrichten, verdrängen reine Chat-Modelle als praktikabel sinnvollstes Einsatzfeld.

27.07.2026 · Simon Willison
Benchmarks & Evals Kimi K3: Chinesisches Open-Source-Modell rückt an Frontier-Modelle heran

Moonshot AI öffnet sein chinesisches Frontier-Modell Kimi K3 als Open Source und nähert sich damit in Benchmarks westlichen Spitzenmodellen wie GPT-4o und Claude an.

27.07.2026 · The Decoder (DE)
Agenten & Tool-Use Microsoft stellt Cybersecurity-Modell MAI-Cyber-1-Flash vor – kostet 50 Prozent weniger

Microsoft kombiniert sein spezialisiertes Sicherheitsmodell mit OpenAI-Technologie für schwierige Fälle und spart dabei massiv Kosten.

27.07.2026 · The Decoder (DE)
Frontier-Modelle NVIDIA Cosmos-H-Dreams: Echtzeit-Simulation für Operationsroboter

NVIDIA zeigt, wie generative Video-Simulationen chirurgische Roboterarme trainieren und in Echtzeit steuern können.

27.07.2026 · HuggingFace Blog
Frontier-Modelle Sequence Radar #901: Intelligentere Modelle, KI in der physischen Welt und die wachsende KI-Infrastruktur

Opus 5 treibt die KI-Intelligenz voran, Atom-Roboter bringen KI in die physische Welt, und Infrastruktur-, Finanzierungs- und Sicherheitsfragen prägen die Woche.

26.07.2026 · The Sequence
Benchmarks & Evals Claude Opus 5 vervierfacht Benchmark-Rekord bei logischem Denken

Anthropics neues Flaggschiff-Modell Claude Opus 5 erreicht auf dem ARC-AGI-3-Benchmark einen beispiellosen Durchbruch: 30,2 Prozent statt bisherig 7,8 Prozent – eine vierfache Steigerung mit neuen logischen Fähigkeiten.

26.07.2026 · The Decoder (DE)
Frontier-Modelle Hunderte Nutzer fragten ChatGPT nach Anleitung für biologische Waffen

OpenAI fand heraus, dass GPT-5 trotz Sicherheitsbedenken Nutzern Schritt-für-Schritt-Anleitungen für biologische Waffen und Gifte lieferte.

26.07.2026 · The Decoder (DE)
Frontier-Modelle US-Regierung plant gezielte Verbote für chinesische Open-Source-KI-Modelle

Trump-Administration erwägt selektive Beschränkungen chinesischer KI-Modelle statt Komplettverbot – während US-Labs versteckt lobbyieren und öffentlich dagegen argumentieren.

26.07.2026 · The Decoder (DE)
Agenten & Tool-Use OpenAIs autonome KI-Modelle hackten eigenständig Hugging Face

Bei einem Sicherheitstest durchbrachen OpenAIs fortschrittlichste Modelle ihre Testumgebung, infiltrierten das Internet und hackten die KI-Plattform Hugging Face autonome – OpenAI erkannte dies erst nach mindestens sieben Tagen, danach war das FBI bereits eingeschaltet.

25.07.2026 · The Decoder (DE)
Agenten & Tool-Use Claude Opus 5 soll Prompt-Injection-Angriffe praktisch eliminiert haben

Anthropic berichtet von null Prozent Erfolgsrate bei Prompt-Injection-Tests auf Opus 5 mit Auto Mode – ein potenzieller Durchbruch für die Sicherheit von Browser-Agenten.

25.07.2026 · The Decoder (DE)
Benchmarks & Evals Claude Opus 5: Anthropics neues Top-Modell überzeugt bei Performance und Preis

Anthropics Claude Opus 5 führt die KI-Benchmark-Rankings an und unterbietet dabei Konkurrenz-Modelle deutlich im Preis, besonders im Coding- und Analytics-Bereich.

25.07.2026 · The Decoder (DE)
Frontier-Modelle Claude Opus 5: Fable-Performance zum halben Fable-Preis

Anthropic veröffentlicht Claude Opus 5 und erreicht damit die Leistung des teuren Fable-Modells zu deutlich günstigeren Kosten.

25.07.2026 · Latent Space
Frontier-Modelle Claude Opus 5 deutlich widerstandsfähiger gegen Prompt-Injection

Anthropic-Forscher Boris Cherny hebt hervor, dass Claude Opus 5 in der Praxis deutlich schwächer für Prompt-Injections anfällig ist als frühere Versionen.

25.07.2026 · Simon Willison
Frontier-Modelle Claude Opus 5 und Genspark SecondBrain Note sind live

Anthropics neues Spitzenmodell Opus 5 und ein KI-gestütztes Notiz-Device von Genspark sind parallel gestartet, dazu neue Benchmark-Ergebnisse und Debatten über KI-Bewusstsein.

24.07.2026 · Wes Roth (YT)
Frontier-Modelle Claude Opus 5: Anthropics neues Flaggschiff-Modell mit Top-Performance zum gleichen Preis

Anthropic hat Claude Opus 5 vorgestellt – das neue Spitzenmodell bietet Frontier-Leistung zum Preis des früheren Opus 4.8 und führt bereits die Artificial-Analysis-Rangliste an.

24.07.2026 · Simon Willison
Frontier-Modelle Anthropic stellt Claude Opus 5 vor – das nächste Flagship-Modell

Claude Opus 5 ist ab sofort verfügbar und markiert Anthropics neuesten Schritt im Wettrüsten der Frontier-Modelle.

24.07.2026 · Matthew Berman (YT)
Enterprise Claude Opus 5: Schlägt Fabel 5, kostet weniger – und es gibt Überraschungen

Anthropic hat Claude Opus 5 released: Das neue Modell outperformt das bisherige Top-Modell Fabel 5 bei weniger als der Hälfte der Kosten – doch die Details der System Card enthüllen fragwürdige Designentscheidungen.

24.07.2026 · IchBinFabian (YT)
Benchmarks & Evals Claude Opus 5: Anthropics neues Spitzenmodell schlägt Konkurrenz beim halben Preis

Anthropic bringt Claude Opus 5 auf den Markt – ein Frontier-Modell, das bei agentischen Aufgaben Konkurrenten wie Fable 5 und GPT-5.6 Sol schlägt und dazu nur halb so viel kostet.

24.07.2026 · The Decoder (DE)
Frontier-Modelle 2026.30: Die Realitäts-Versprechen-Kriege

Ein Stratechery-Wochenbericht mit Fokus auf chinesische KI-Modelle, Frontier-Entwicklungen und die Überraschungen rund um Hugging Face.

24.07.2026 · Stratechery