Nvidia’s Nemotron 3.5 Lightning setzt auf schnelle, effiziente KI-Agenten
Nvidia’s Nemotron 3.5 Lightning nutzt Sparse-Aktivierung und Quantisierung, um schnelle Open-Weight-Inferenz zu liefern, und zielt auf KI-Agenten mit hohem Volumen statt auf Spitzenwerte bei Benchmarks.
