91 Artikel
Architektur-Innovation Die fehlenden 5%: Warum Model Distillation schwieriger ist als gedacht

Model Distillation verkleinert und beschleunigt KI-Modelle – doch die Kunst liegt darin, zu wählen, was der schmalere Student-Modell nicht vergessen darf.

08.09.2026 · The Sequence
Architektur-Innovation Der Frontier-Modell-Tracker: Was Astra wählt – und alle anderen Frontier-Modelle auch

Eine Analyse zeigt, welche Architektur-Entscheidungen (AEO) führende KI-Modelle treffen und was das für Entwickler bedeutet.

07.09.2026 · Latent Space
Agenten & Tool-Use Agent-Schwärme praktisch einsetzbar: OpenAI-Vorfall zeigt Chancen und Risiken

Ein vermeintlicher OpenAI-Hack durch eigene Agenten zeigt, dass Agent-Schwärme keine theoretische Zukunftsvision mehr sind, sondern bereits funktionieren – und kontrolliert werden müssen.

07.09.2026 · IndyDevDan (YT)
Architektur-Innovation NeoMME: Ein effizienter multimodal-nativer mehrsprachiger Encoder

Ein neues Modell kombiniert Multimodal-Verarbeitung mit nativer Mehrsprachigkeit und optimierter Effizienz für globale Anwendungen.

03.09.2026 · HuggingFace Blog
Agenten & Tool-Use GPT-6 Astra erreicht kritische Sicherheitsstufe – mit rätselhafter neuer Architektur

OpenAIs Astra-Modell nutzt eine neue „Recurrent Depth"-Technik, die KI-Denkvorgänge im latenten Raum verschleiert statt sie lesbar zu machen – genau wie Sicherheitsforscher vor dem Verlust von Transparenz warnten.

02.09.2026 · Wes Roth (YT)
Agenten & Tool-Use WikiSkill: Google gibt KI-Agenten eine persistente Wissensbasis

Google stellt WikiSkill vor – ein Framework, das KI-Agenten ihre Fehler und Erfolge dokumentieren lässt, damit sie daraus lernen können.

29.08.2026 · The Decoder (DE)
Agenten & Tool-Use Google Deepmind: KI-Forscher "Co-Scientist" schreitet vom Ideengenerator zum Labor-Partner vor

Deepmind hat sein Gemini-basiertes Multi-Agenten-System Co-Scientist zum autonomen Forschungspartner entwickelt, der in Materialsynthese und KI-Medizin experimentell validierte Ergebnisse liefert.

28.08.2026 · The Decoder (DE)
Agenten & Tool-Use Governance für autonome KI-Agenten: Warum die Datenschicht zum Sicherheitsschlüssel wird

Wenn KI-Agenten autonom handeln, reichen abstrakte Richtlinien nicht – Governance muss als technische Kontrolle direkt in der Datenschicht durchgesetzt werden.

27.08.2026 · VentureBeat AI
Agenten & Tool-Use Orchestrierung statt Automatisierung: Der neue Kern von KI-gestütztem Kundenservice

Unternehmen scheitern oft darin, KI-Agenten in veraltete Systeme zu integrieren – der Schlüssel liegt stattdessen in intelligenter Orchestrierung aller Komponenten.

26.08.2026 · VentureBeat AI
Architektur-Innovation Granite 4.2: Wie IBMs neue Language Models entstehen

IBM zeigt die technische Architektur hinter seinen Granite 4.2 LLMs und gibt Einblick in Design-Entscheidungen und Trainings-Ansätze.

25.08.2026 · HuggingFace Blog
Architektur-Innovation 4-Bit-Quantisierung: Komprimiertes Modell schlägt vollpräzisions-Original

Forscher demonstrieren eine Quantisierungs-Technik, bei der ein stark komprimiertes 4-Bit-Modell die Leistung des Original-Modells mit voller Präzision übertrifft.

25.08.2026 · HuggingFace Blog
Architektur-Innovation The Sequence Knowledge #920: Die Physik des Lernens – Destillations-Skalierungsgesetze

Neue Erkenntnisse über die mathematischen Gesetzmäßigkeiten beim Knowledge Distillation – wie kleinere Modelle effizient von größeren lernen können.

25.08.2026 · The Sequence
Agenten & Tool-Use Warum KI-Agenten mit Skills bessern abschneiden – und wann sie scheitern

Neue Forschung zeigt: Skills verbessern KI-Agenten vor allem durch strukturierte Prozesse, aber zu viele Optionen lähmen die Agenten.

22.08.2026 · The Decoder (DE)
Architektur-Innovation Mental World Modeling: KI-Weltmodelle lernen menschliches Denken

Ein neues Framework ergänzt Weltmodelle wie Sora um mentale Variablen – mit überraschend großem Effekt auf die Vorhersagequalität.

22.08.2026 · The Decoder (DE)
Agenten & Tool-Use Die Entwicklung der Agent-Infrastruktur

Modelle integrieren die Agent-Infrastruktur zunehmend in ihre Gewichte – künftig könnte sie eher menschliche Aufmerksamkeit lenken als Modelle steuern.

22.08.2026 · Latent Space
Architektur-Innovation Der Param-Tod: Z.ai-Chef Jie Tang zur GLM 5.3 und neuen Post-Training-Skalierungsgesetzen

Zhipus CEO Jie Tang diskutiert auf X die Implikationen von GLM 5.3 und einen paradigmatischen Wechsel in der KI-Skalierung weg von Parameteranzahl.

20.08.2026 · Latent Space
Architektur-Innovation Erweiterbare Software mit LLMs: Das Sandbox-Modell der Zukunft

LLMs könnten den Weg für eine neue Architektur offenbaren: Apps mit stabilem Core und benutzerdefinierten LLM-Erweiterungen in sicheren Sandboxen.

19.08.2026 · Simon Willison
Agenten & Tool-Use Die zwei Seiten von Coding Agents: Produktivität und die Verfallsrisiken der Architektur

KI-Coding-Agenten können die Produktivität um ein Vielfaches steigern, aber sie gefährden die konzeptionelle Integrität von Software – ein tieferes Problem als nur mehr Code.

19.08.2026 · Simon Willison
Architektur-Innovation Test-Time-Compute-Destillation: Denkzeit als dauerhafte Fähigkeit

Wie können Modelle langfristig von Rechenzeit beim Inferenzen lernen – ein vielversprechender Weg zur Verbesserung von KI-Fähigkeiten?

18.08.2026 · The Sequence
Architektur-Innovation KI-Modelle vergessen Nutzerbedingungen bei Kontextkomprimierung

Forscher zeigen: Wenn KI-Systeme lange Gespräche komprimieren, gehen im Schnitt 83 Prozent der Nutzeranweisungen verloren – ein kritisches Sicherheitsrisiko.

18.08.2026 · The Decoder (DE)