234 Artikel · 2026-08
Agenten & Tool-Use Über die Programmierung ohne Programmierer – ein Gedanke von Paul Dix

Paul Dix beschreibt ein Wendepunkt-Moment: KI hat eine Million Zeilen Code geschrieben und iterativ verfeinert, bis daraus zuverlässige Software für Millionen wurde – ein Szenario, das die Zukunft der Softwareentwicklung neu definieren könnte.

26.08.2026 · Simon Willison
Coding-Modelle Z.ai sperrt GLM 5.3 weg – zu gefährlich zum Hacken? Ich teste es trotzdem

Z.ai veröffentlicht GLM 5.3 ohne offene Gewichte, weil das Modell beim Training zu gut im Aufspüren von Sicherheitslücken wurde – eine Video-Analyse testet das Modell live und hinterfragt die Hacker-Narrative.

26.08.2026 · IchBinFabian (YT)
Benchmarks & Evals Das AI-Modell-Ranking: Markt-Verschiebungen zwischen Frontier und Open Source

Ein virales KI-Modell-Ranking spaltet die Community – doch der wahre Trend ist, dass Unternehmen nun ganze Model-Stacks kombinieren statt sich auf einen Winner zu verlassen.

26.08.2026 · AI Daily Brief (YT)
Enterprise OpenAI stellt KI-Chip "Jalapeño" vor – übertrifft Nvidias Top-Modelle bei Inferenz

OpenAIs erster Eigenbau-Chip soll in Benchmarks bereits Nvidias Blackwell und die kommende Rubin schlagen – ein dramatischer Schlag in der Chipindustrie.

25.08.2026 · The Decoder (DE)
Agenten & Tool-Use Google bringt KI-Lösung für Rechtsanwälte auf den Markt

Google startet Gemini Enterprise for Legal, eine spezialisierte KI-Lösung für Kanzleien, die über vorkonfigurierte Agenten Verträge prüfen und Rechtsrecherche automatisieren soll.

25.08.2026 · The Decoder (DE)
Architektur-Innovation Granite 4.2: Wie IBMs neue Language Models entstehen

IBM zeigt die technische Architektur hinter seinen Granite 4.2 LLMs und gibt Einblick in Design-Entscheidungen und Trainings-Ansätze.

25.08.2026 · HuggingFace Blog
Agenten & Tool-Use Meta bringt KI-Agent Hatch und Modell Watermelon

Meta startet seinen KI-Agenten Hatch in Kürze und veröffentlicht im Oktober das neue Modell Watermelon als OpenClaw-Alternative.

25.08.2026 · The Decoder (DE)
Agenten & Tool-Use Nvidia startet Groq-Inferenzchip: Neue Rekorde beim KI-Agent-Speed

Nvidias neuer Groq 3 LPX Chip erreicht 3.400 Token pro Sekunde – viermal schneller als Konkurrent Cerebras, allerdings mit deutlich höherem Hardware-Aufwand.

25.08.2026 · The Decoder (DE)
Architektur-Innovation The Sequence Knowledge #920: Die Physik des Lernens – Destillations-Skalierungsgesetze

Neue Erkenntnisse über die mathematischen Gesetzmäßigkeiten beim Knowledge Distillation – wie kleinere Modelle effizient von größeren lernen können.

25.08.2026 · The Sequence
Frontier-Modelle Chinesische Hacker nutzen KI-Modelle wie Deepseek für massiv mehr Cyberangriffe

Taiwanesische Sicherheitsexperten dokumentieren: Chinesische Hackergruppen haben ihre Angriffe mehr als verdoppelt, seitdem sie KI-Modelle wie Deepseek, ChatGPT und Claude für Exploit-Codes und Netzwerk-Scans einsetzen.

25.08.2026 · The Decoder (DE)
Coding-Modelle DeepSeek V4 Flash vs. Claude Code: 90x billiger, aber reicht die Qualität?

Ein praktischer Vergleich zeigt: DeepSeek V4 Flash kostet 4 Cent statt 3,34 Euro pro Aufgabe – doch die Codequalität ist deutlich unterschiedlich.

25.08.2026 · IchBinFabian (YT)
Enterprise Der vollständige Stack hinter OpenAIs Strategie für skalierbare KI

OpenAI-CFO Sarah Friar erklärt, wie Fortschritte bei Chips, Rechenkapazität, Modellen und Produkten zusammenwirken, um intelligentere Systeme günstiger und in grösserem Massstab bereitzustellen.

25.08.2026 · OpenAI Blog
Frontier-Modelle Jalapeño: OpenAIs neuer Inference-Chip zeigt Branchenleistung

OpenAI stellt erste Ergebnisse seines Custom-Chips Jalapeño vor, der schnellere und energieeffizientere KI-Inferenz mit höherem Durchsatz und niedrigerer Latenz ermöglicht.

25.08.2026 · OpenAI Blog
Agenten & Tool-Use OpenAI-Insider über KI-Agenten, Codex und die Zukunft der Zusammenarbeit

Ein OpenAI-Mitarbeiter diskutiert kommende KI-Agenten, rekursive Selbstverbesserung und wie KI bald schneller arbeitet als Menschen folgen können.

24.08.2026 · Matthew Berman (YT)
Frontier-Modelle Alibabas Wan3.0: Videogenerierung aus Text und Dokumenten

Alibaba präsentiert Wan3.0, das aus Text, Bildern und PDFs Videos bis 30 Sekunden Länge generiert – ein Schlag gegen OpenAI und Runway, während der Konzern Millarden in KI-Entwicklung investiert.

24.08.2026 · The Decoder (DE)
Agenten & Tool-Use Intelligenz-Explosion: Multi-Agent-Systeme mit Claude, DeepSeek und Gemini kombinieren

Fünf neue Top-Modelle in fünf Tagen – ein Developer zeigt, wie man mehrere KI-Modelle gleichzeitig orchestriert, statt sich in eine Plattform zu sperren.

24.08.2026 · IndyDevDan (YT)
Enterprise Thomson Reuters investiert 40 Millionen Dollar in eigenes Sprachmodell

Der Medien- und Datengigant Thomson Reuters entwickelt sein eigenes LLM auf Basis von Alibabas Qwen und zeigt, wie Konzerne KI-Vorteile durch proprietäre Trainings-Daten multiplizieren.

24.08.2026 · The Decoder (DE)
Coding-Modelle GPT-5.6 startet in Kiro: besseres Preis-Leistungs-Verhältnis für Entwickler

OpenAI macht GPT-5.6 über die Entwicklerplattform Kiro verfügbar und verspricht Entwicklern ein optimiertes Preis-Leistungs-Verhältnis für Software-Entwicklung.

24.08.2026 · OpenAI Blog
Dev-Tools Deepseek V4 Flash lokal auf einer 3090: FreeToken-Test mit Budget-Hardware

Mit der neuen FreeToken-Engine laufen Frontier-Modelle wie Deepseek V4 Flash auch auf günstigerer Single-GPU-Hardware wie einer Nvidia 3090.

24.08.2026 · Digital Spaceport (YT)
Enterprise Nvidia investiert in Perplexity: AI-Suchmaschine wird 30-Milliarden-Startup

Nvidia beteiligt sich an der KI-Suchmaschine Perplexity und treibt deren Bewertung auf über 30 Milliarden Dollar – ein Geschäftsmodell, das Kapital in Chipverkäufe zurückverwandelt.

24.08.2026 · The Decoder (DE)