459 Artikel · 2026-07
Agenten & Tool-Use DeepSeek-V4-Flash: Chinesisches Flaggschiff mit beeindruckendem Preis-Leistungs-Verhältnis

DeepSeeks neue 304-Milliarden-Parameter-Variante gilt als aktuell bestes Preis-Leistungs-Verhältnis im KI-Modell-Markt und outperformt deutlich teuerere Konkurrenten.

31.07.2026 · Simon Willison
Agenten & Tool-Use DeepSeek V4 Flash 0731: Das beste Preis-Leistungs-Verhältnis der KI-Welt

DeepSeeks neues 304-Milliarden-Parameter-Modell mit verbesserten Agent-Fähigkeiten bietet zum niedrigsten Preis die beste Intelligenz-zu-Kosten-Quote am Markt.

31.07.2026 · Simon Willison
Agenten & Tool-Use MCP 2.0 – Das Model Context Protocol wird schlanker und interessant

Die neue Stateless-Version des Model Context Protocol vereinfacht die Integration von Tools in Agent-Systemen erheblich und weckt damit die Aufmerksamkeit von Entwicklern neu.

31.07.2026 · Simon Willison
Agenten & Tool-Use Model Context Protocol 2.0: Anthropics Agent-Standard wird wieder interessant

Die neue stateless MCP-Spezifikation vereinfacht die Implementierung von Agent-Tools dramatisch und entfacht neues Interesse für Anthropics offenes Protokoll.

31.07.2026 · Simon Willison
Frontier-Modelle Die Open-Weight-Revolution: Podcast-Diskussion zu offenen vs. proprietären KI-Modellen

Simon Willison diskutiert mit Oxide-Gründern über den Aufstieg von Open-Weight-Modellen wie Kimi K3, Cybersecurity-Pannen und Machtverschiebungen in der AI-Industrie.

31.07.2026 · Simon Willison
Frontier-Modelle Die Open-Weight-Revolution: Podcast mit Simon Willison über offene Modelle und Frontier-KI

Simon Willison diskutiert in der Oxide-Podcast-Episode die rasante Entwicklung offener KI-Modelle – und wie Kimi K3 und DeepSeek zeigen, dass sie mit proprietären Frontier-Modellen mithalten können.

31.07.2026 · Simon Willison
Benchmarks & Evals smevals: Ein Eval-Framework zum Testen von KI-Modellen und Prompts

Simon Willison stellt smevals vor – ein neues Open-Source-Tool zur Bewertung von KI-Modellen über verschiedene Konfigurationen hinweg mit grafischer Dashboard-Auswertung.

31.07.2026 · Simon Willison
Dev-Tools Codeberg zieht eine Grenze gegen LLM-Projekte

Der gemeinnützige Git-Hoster stellt keine Nutzerdaten für LLM-Training bereit und will Projekte, die überwiegend per LLM entstehen, nicht mehr hosten. Es geht dabei weniger um Codequalität als um Ressourcen und Vertrauen.

31.07.2026 · PyGround Redaktion
Benchmarks & Evals Claude Mythos findet Schwächen in Kryptografie-Kandidaten

Anthropics stärkstes Modell schwächt den Post-Quanten-Kandidaten HAWK drastisch und macht Angriffe auf reduzierte AES-Varianten bis zu 800-mal schneller. Produktiv eingesetzte Verfahren sind nicht betroffen, noch nicht.

31.07.2026 · PyGround Redaktion
Labs & Industrie Offene Gewichte: Jensen Huang legt vor, Anthropic hält dagegen

Nvidias Chef eröffnet seinen X-Account mit einem Plädoyer für offene Modellgewichte, fast alle großen Labs unterschreiben den begleitenden Brief. Anthropic nicht, und Dario Amodei erklärt warum.

31.07.2026 · PyGround Redaktion
Labs & Industrie Pacing the Frontier: KI-Entwickler fordern eine Bremse, die es noch nicht gibt

Über 1.300 Beschäftigte von OpenAI, Anthropic, Google DeepMind und Meta fordern von der US-Regierung Werkzeuge, mit denen sich die KI-Entwicklung notfalls verlangsamen ließe.

31.07.2026 · PyGround Redaktion
Agenten & Tool-Use Sechs zentrale Fragen für Enterprise-AI: Strategie, Kosten, Sicherheit

Enterprise-Unternehmen ringen mit Strategie-Fragen zu Kosten-Allokation, Mitarbeiter-Upskilling und agentic AI – während Sam Altmans Washington-Besuche politische Debatten um Modell-Freigaben und Sicherheits-Standards auslösen.

31.07.2026 · AI Daily Brief (YT)
Frontier-Modelle Gemini Robotics 2: Googles KI-Modell steuert Roboter aller Art

Google DeepMind präsentiert Gemini Robotics 2, ein Vision-Language-Action-Modell, das Roboter verschiedenster Bauformen – von Tischgeräten bis zu humanoiden Ganzkörperrobotern – einheitlich steuern kann.

31.07.2026 · The Decoder (DE)
Benchmarks & Evals Mira Muratis Thinking Machines: Inkling Small schlägt Größe mit Effizienz

Das neue Open-Weights-Reasoning-Modell Inkling Small ist ein Drittel kleiner als sein Vorgänger, übertrifft ihn aber bei Coding- und Reasoning-Aufgaben.

31.07.2026 · The Decoder (DE)
Enterprise Webinar: KI-ROI zuverlässig messen – Methoden für die Praxis

Ein Webinar vermittelt praktische Ansätze, um den wirtschaftlichen Nutzen von KI-Investitionen zu quantifizieren und intern nachvollziehbar zu dokumentieren.

31.07.2026 · The Decoder (DE)
Benchmarks & Evals Deepseek V4 Flash überholt - kostet 60 Prozent weniger als OpenAIs GPT-5.6 Luna

Deepseeks aktualisiertes Budget-Modell schließt bei der Performance-Messung fast zu OpenAIs Top-Modell auf, kostet aber deutlich weniger pro Aufgabe.

31.07.2026 · The Decoder (DE)
Infrastruktur AMD Ryzen AI Halo: KI-Chips für den lokalen Einsatz

AMD präsentiert neue Ryzen-AI-Chips für Edge-Computing, die Generative KI lokal auf Endgeräten ohne Cloud-Abhängigkeit ermöglichen.

31.07.2026 · Sam Witteveen (YT)
Enterprise EU baut sieben KI-Gigafabriken – doch der Rückstand zur USA wächst

Die EU-Kommission startet Ausschreibungen für KI-Rechenzentren mit bis zu 30 Milliarden Euro – ein Bruchteil dessen, was US-Tech-Konzerne allein heuer in Infrastruktur pumpen.

31.07.2026 · The Decoder (DE)
Infrastruktur Intelligenz im Überfluss: Wie fortgeschrittene KI zugänglicher wird

Ein ganzheitlicher Ansatz soll KI leistungsfähiger, billiger und breiter einsetzbar machen.

31.07.2026 · OpenAI Blog
Labs & Industrie OpenAI setzt auf Verantwortung: Wie der Konzern die EU-AI-Act erfüllt

OpenAI legt dar, wie seine Sicherheits-, Transparenz- und Governance-Praktiken die verantwortungsvolle KI-Regulierung in Europa unterstützen.

31.07.2026 · OpenAI Blog