Architektur-Innovation
Google DiffusionGemma: Text-Modell mit parallelem Denken statt Token-für-Token
Google Deepmind zeigt, wie Gemma-4 mit minimatem Budget in ein Diffusionsmodell umgewandelt wird, das 256 Tokens parallel statt sequenziell erzeugt – schneller, aber weniger präzise bei komplexem Reasoning.
09.08.2026 · The Decoder (DE)