52 Artikel
Architektur-Innovation Tencent stellt Hy3 vor: 295-Milliarden-Parameter-Modell mit Mixture-of-Experts-Architektur

Tencents neues Open-Source-Modell Hy3 erreicht laut Benchmarks die Leistung deutlich größerer Konkurrenten, während es nur ein Siebtel der Parameter aktiv nutzt.

06.07.2026 · The Decoder (DE)
Agenten & Tool-Use AI-Engineer-Konferenz: Die große Schleifen-Debatte und der Stand der KI-Entwicklung

Die AI Engineer World's Fair endete mit einer Debatte über Loops, einem Bericht zum Stand der KI-Entwicklung und Keynotes über künftige Projekte.

03.07.2026 · Latent Space
Agenten & Tool-Use Skill Engineering: Warum KI-Agenten menschliche Anleitung brauchen

Ein Plädoyer gegen einfache, automatisierte KI-Systeme: Experte Paul Bakaus erklärt, warum menschliches Urteilsvermögen beim Design von Agenten unverzichtbar bleibt.

02.07.2026 · Latent Space
Architektur-Innovation Warum Spezialisierung unvermeidlich ist

Die Zukunft der KI gehört spezialisierten Modellen, nicht universellen Universalgenies – ein Paradigmenwechsel in der KI-Entwicklung.

30.06.2026 · HuggingFace Blog
Architektur-Innovation Modell-Destillation einfach erklärt

Ein verständlicher Überblick über die Kernprinzipien der Destillation von KI-Modellen.

30.06.2026 · The Sequence
Agenten & Tool-Use Vom Chatbot zum digitalen Kollegen: Forschende zeigen den nächsten KI-Schritt

Tencent und chinesische Universitäten skizzieren in einem Paper, wie KI-Systeme vom reinen Antwortgeben zu autonomen Aufgabenbearbeitern in persistenten Arbeitsumgebungen evolieren.

28.06.2026 · The Decoder (DE)
Architektur-Innovation iLLaDA: ByteDance-Forscher erkunden Diffusions-Alternative zu klassischen Sprachmodellen

Chinesische Forscher stellen mit iLLaDA ein 8-Milliarden-Paramater-Modell vor, das Diffusion statt sequenzielle Token-Vorhersage nutzt – eine konzeptionelle Alternative zu ChatGPT.

27.06.2026 · The Decoder (DE)
Agenten & Tool-Use Google veröffentlicht Playbook für Agentic Engineering – Das Modell ist nur 10% der Lösung

Google hat ein 50-seitiges Whitepaper zur KI-gestützten Softwareentwicklung veröffentlicht und argumentiert: Echte Skalierbarkeit liegt nicht im Modell, sondern im „Harness" – dem Kontext, den Tools und den Sicherheitsgarantien ringsum.

25.06.2026 · Cole Medin (YT)
Architektur-Innovation The Sequence Knowledge #882: Tiefer Einstieg in Model Distillation

Eine neue Serie widmet sich einer der wichtigsten Techniken moderner KI-Entwicklung.

24.06.2026 · The Sequence
Architektur-Innovation FFASR-Leaderboard: Spracherkennung in der echten Welt im Test

Ein neues Benchmarking-System misst Spracherkennungsmodelle anhand realistischer, schwieriger Audioszenarien statt idealisierter Testbedingungen.

24.06.2026 · HuggingFace Blog
Agenten & Tool-Use Google ersetzt Gemini-Standard-API durch neue Interactions-Schnittstelle

Google Deepmind führt die Interactions API als neuen Standard für Gemini ein und ersetzt damit die bisherige generateContent-Schnittstelle mit vereinfachtem Schema und neuen Agent-Funktionen.

22.06.2026 · The Decoder (DE)
Agenten & Tool-Use Sakana Fugu: Schwarmintelligenz-Orchestrator tritt gegen Claude und Fable an

Das japanische Start-up Sakana AI präsentiert Fugu, einen Orchestrator, der mehrere KI-Modelle dynamisch koordiniert und dabei mit Frontier-Modellen konkurrieren soll.

22.06.2026 · The Decoder (DE)
Agenten & Tool-Use MCP als Authentifizierungs-Gateway: Sean Lynch zur Zukunft der Model-Context-Protocol

Ein Kernvorteil von MCP liegt darin, Authentifizierungsabläufe außerhalb des Agent-Kontexts zu isolieren – möglicherweise sogar komplett außerhalb der Infrastruktur.

19.06.2026 · Simon Willison
Architektur-Innovation Jenseits von LoRA: Lässt sich die populärste Fine-Tuning-Methode schlagen?

Neue Forschung untersucht, ob es effektivere Alternativen zu LoRA für das effiziente Fine-Tuning von Large Language Models gibt.

18.06.2026 · HuggingFace Blog
Architektur-Innovation MolmoMotion: Sprachgesteuerte 3D-Bewegungsvorhersage

Ein neues Modell kombiniert Sprachverständnis mit 3D-Bewegungsvorhersage und kann komplexe menschliche Bewegungen aus natürlichsprachlichen Beschreibungen vorhersagen.

17.06.2026 · HuggingFace Blog
Architektur-Innovation Google DeepMinds DiffusionGemma: Erster ernsthafter Diffusions-Ansatz statt Transformer

DiffusionGemma gilt als eines der vielversprechendsten Nicht-Transformer-Modelle für die Sprachgenerierung und stellt einen neuen Architektur-Weg dar.

17.06.2026 · The Sequence
Architektur-Innovation Die Sequenz-Wissensfabrik #878: Jenseits von Transformer – Was wir gelernt haben

Eine neue Serie über Distillation und aktuelle Erkenntnisse über die Grenzen und Alternativen zu Transformer-Architekturen.

16.06.2026 · The Sequence
Agenten & Tool-Use Omnigent: Orchestrierungs-Framework für Multi-Model-Coding-Agenten

Open-Source-Projekt zeigt, wie verschiedene KI-Modelle (Claude, Codex, Kimi) in einer einzigen Plattform koordiniert werden – mit spezialisierter Rollenverteilung und Human-in-the-Loop-Governance.

15.06.2026 · Cole Medin (YT)
Architektur-Innovation Mirage: Wie Video-KI räumliches Langzeitgedächtnis bekommt

Microsoft-Forschung zeigt, wie Video-Modelle räumliche Szenen im latenten Raum speichern können – effizienter und stabiler als bisherige Ansätze.

14.06.2026 · The Decoder (DE)
Agenten & Tool-Use Loopcraft: Die Kunst verschachtelter Schleifen

Ein konzeptioneller Beitrag von Peter Steinberger, Boris Cherny und Andrej Karpathy zeigt elegante Muster für rekursive KI-Architekturen.

12.06.2026 · Latent Space