Nvidias Nemotron 3.5 Lightning: Kleine Modelle, großer Speed-Vorteil

Nvidias offenes Nemotron 3.5 Lightning setzt auf Geschwindigkeit statt maximale Intelligenz
6/10 The Decoder (DE) 11.08.2026 Frontier-Modelle Open Source Produkt-Launch

Nvidia hat Nemotron 3.5 Lightning vorgestellt, ein Open-Weights-Modell mit nur 3,6 Milliarden aktiven Parametern, das trotz seiner Kompaktheit im Intelligence Index mit OpenAIs viermal größerem gpt-oss-120b mithalten kann. Mit etwa 670 Token pro Sekunde ist es das schnellste Modell im direkten Vergleich. Diese Veröffentlichung unterstreicht Nvidias Strategie, Effizienz und praktische Einsatzbarkeit über Parametergröße zu stellen – ein Trend, der für Enterprise-Anwendungen und Edge-Deployment immer wichtiger wird.

Zum Originalartikel