NVIDIA stellt Nemotron 3.5 Lightning vor, ein neues Mixture-of-Experts-Modell aus der Nemotron-Familie, das auf extreme Geschwindigkeit und spezialisierte Task-Ausführung für lange laufende Agenten optimiert ist. Das Modell wird in mehreren Quantisierungsvarianten (NVFP4) angeboten und auf Hugging Face bereitgestellt. Nach Pinchbench-Benchmarks bietet das Modell eine verbesserte Balance zwischen Latenz und Accuracy für Agent-Workloads – ein wichtiges Anwendungsfeld, da KI-Agenten in Produktion oft unter Zeitdruck handeln müssen. Die Veröffentlichung signalisiert Nvidias fortgesetzten Push in den Softwarestack: Nicht nur Hardware, sondern auch optimierte, produktionsreife Modelle für spezifische Enterprise-Use-Cases.