nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DFlash Text Generation • 0.7B • Updated 22 days ago • 2.18k • 19
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DSpark Text Generation • 0.8B • Updated 22 days ago • 215k • 31
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DSpark Text Generation • 0.8B • Updated 22 days ago • 215k • 31
nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4-DFlash Text Generation • 0.7B • Updated 22 days ago • 2.18k • 19
view article Article Introducing SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding nvidia • Mar 19 • 50
view article Article Introducing SPEED-Bench: A Unified and Diverse Benchmark for Speculative Decoding nvidia • Mar 19 • 50
ReGuLaR: Variational Latent Reasoning Guided by Rendered Chain-of-Thought Paper • 2601.23184 • Published Jan 30 • 35