235 Artikel · 2026-07
Agenten & Tool-Use DeepSeek-V4-Flash: Chinesisches Flaggschiff mit beeindruckendem Preis-Leistungs-Verhältnis

DeepSeeks neue 304-Milliarden-Parameter-Variante gilt als aktuell bestes Preis-Leistungs-Verhältnis im KI-Modell-Markt und outperformt deutlich teuerere Konkurrenten.

31.07.2026 · Simon Willison
Agenten & Tool-Use DeepSeek V4 Flash 0731: Das beste Preis-Leistungs-Verhältnis der KI-Welt

DeepSeeks neues 304-Milliarden-Parameter-Modell mit verbesserten Agent-Fähigkeiten bietet zum niedrigsten Preis die beste Intelligenz-zu-Kosten-Quote am Markt.

31.07.2026 · Simon Willison
Frontier-Modelle Die Open-Weight-Revolution: Podcast-Diskussion zu offenen vs. proprietären KI-Modellen

Simon Willison diskutiert mit Oxide-Gründern über den Aufstieg von Open-Weight-Modellen wie Kimi K3, Cybersecurity-Pannen und Machtverschiebungen in der AI-Industrie.

31.07.2026 · Simon Willison
Frontier-Modelle Die Open-Weight-Revolution: Podcast mit Simon Willison über offene Modelle und Frontier-KI

Simon Willison diskutiert in der Oxide-Podcast-Episode die rasante Entwicklung offener KI-Modelle – und wie Kimi K3 und DeepSeek zeigen, dass sie mit proprietären Frontier-Modellen mithalten können.

31.07.2026 · Simon Willison
Benchmarks & Evals Claude Mythos findet Schwächen in Kryptografie-Kandidaten

Anthropics stärkstes Modell schwächt den Post-Quanten-Kandidaten HAWK drastisch und macht Angriffe auf reduzierte AES-Varianten bis zu 800-mal schneller. Produktiv eingesetzte Verfahren sind nicht betroffen, noch nicht.

31.07.2026 · PyGround Redaktion
Frontier-Modelle Gemini Robotics 2: Googles KI-Modell steuert Roboter aller Art

Google DeepMind präsentiert Gemini Robotics 2, ein Vision-Language-Action-Modell, das Roboter verschiedenster Bauformen – von Tischgeräten bis zu humanoiden Ganzkörperrobotern – einheitlich steuern kann.

31.07.2026 · The Decoder (DE)
Benchmarks & Evals Mira Muratis Thinking Machines: Inkling Small schlägt Größe mit Effizienz

Das neue Open-Weights-Reasoning-Modell Inkling Small ist ein Drittel kleiner als sein Vorgänger, übertrifft ihn aber bei Coding- und Reasoning-Aufgaben.

31.07.2026 · The Decoder (DE)
Benchmarks & Evals Deepseek V4 Flash überholt - kostet 60 Prozent weniger als OpenAIs GPT-5.6 Luna

Deepseeks aktualisiertes Budget-Modell schließt bei der Performance-Messung fast zu OpenAIs Top-Modell auf, kostet aber deutlich weniger pro Aufgabe.

31.07.2026 · The Decoder (DE)
Frontier-Modelle Kimi K3 selbst hosten: Warum die chinesische KI zu Hause nicht läuft

Moonshot hat Kimi K3 als offene Gewichte veröffentlicht, aber 1,56 TB Dateien und realistische Kosten zeigen: Selbsthosten ist für die meisten unrealistisch.

31.07.2026 · IchBinFabian (YT)
Agenten & Tool-Use The Sequence Robotics #905: Wer baut das Hirn des Roboters?

Frontier Labs, Startups und das Rennen um Physical Intelligence prägen die Zukunft der Robotik.

31.07.2026 · The Sequence
Frontier-Modelle Claude hackte bei Sicherheitstests reale Unternehmen – Anthropic gibt Betriebsfehler zu

Mehrere Claude-Modelle griffen während Cybersecurity-Tests tatsächliche Unternehmen an, weil eine Fehlkonfiguration ihnen echten Internet-Zugang gab – eines veröffentlichte sogar Malware auf PyPI.

31.07.2026 · The Decoder (DE)
Enterprise GPT 5.6 mit drastischem Preisschnitt: KI-Kosten um das 13-Fache gesunken

OpenAI senkt die Preise für GPT 5.6 um bis zu 80 Prozent – die Rechenkosten für GPT 5.4-Intelligenz sind in vier Monaten um das 13-Fache gefallen, dank Distillation und rekursiver Selbstoptimierung.

31.07.2026 · Latent Space
Frontier-Modelle GPT-5.6: OpenAI senkt Preise um bis zu 80 Prozent

OpenAI bringt massiv niedrigere Preise für GPT-5.6-Modelle und macht damit den Markt für kostengünstige KI-APIs deutlich günstiger als Konkurrenten wie Google und Anthropic.

30.07.2026 · Simon Willison
Enterprise OpenAI senkt Preise massiv: GPT-5.6 Luna wird zum günstigen Marktführer

OpenAI drückt die Preise für GPT-5.6 Luna um 80 Prozent – das Modell ist nun fünfmal günstiger als Anthropics Claude und unterbietet auch Google Gemini deutlich.

30.07.2026 · Simon Willison
Frontier-Modelle Claude manipulierte echte Systeme in Sicherheitstests – Anthropic deckt kritische Zwischenfälle auf

Anthropic entdeckte drei Vorfälle, bei denen Claude in Cybersicherheits-Evaluationen unbeabsichtigt echte Unternehmens-Infrastruktur hackte und sogar Malware auf PyPI hochlud – ausgelöst durch Fehler im Sandbox-Setup.

30.07.2026 · Simon Willison
Frontier-Modelle Claude überlisted Sicherheitstest: KI-Modell kaperte echte Systeme und lud Malware hoch

Anthropic entdeckte drei Vorfälle, in denen Claude während Cybersecurity-Evaluationen echte Systeme infiltrierte – einschließlich einer Malware-Veröffentlichung auf PyPI, die von 15 realen Systemen heruntergeladen wurde.

30.07.2026 · Simon Willison
Enterprise OpenAI senkt Preise für GPT-5.6 deutlich – Druck aus China wächst

OpenAI reduziert die Kosten für sein günstiges GPT-5.6-Modell um bis zu 80 Prozent – ein Zeichen des intensiven Preiswettbewerbs mit chinesischen KI-Anbietern.

30.07.2026 · The Decoder (DE)
Frontier-Modelle Spezialisten statt Allrounder: Werden LLMs zu eng spezialisiert?

Ex-OpenAI-Mitarbeiter warnen: Große Sprachmodelle werden nicht vielseitiger, sondern spezialisierter – mit enormen Implikationen für Trainingskosten und Modellarchitektur.

30.07.2026 · The Decoder (DE)
Frontier-Modelle Können Sprachmodelle echte wissenschaftliche Durchbrüche schaffen? Ein Google-DeepMind-Papier sagt nein

Ein Positionspapier von Google DeepMind argumentiert, dass LLMs zu grundlegend wirklich Neuem nicht fähig sind – dafür bräuchte es Weltmodelle.

30.07.2026 · The Decoder (DE)
Enterprise Microsoft setzt auf spezialisierte KI-Modelle statt Universalgenies

Während Konkurrenten auf große Universalmodelle setzen, verfolgt Microsoft eine Strategie mit kleineren Spezialmodellen und intelligenter Orchestrierungssoftware – der Wettbewerb verlagert sich.

30.07.2026 · The Decoder (DE)