Catalog
Blueprint by nvidia
Quantize Models to NVFP4 with NVIDIA Model Optimizer
Cut memory ~3.5× vs FP16 while keeping accuracy close to FP8, then validate with an OpenAI-compatible endpoint
NVIDIA blueprintStationSparkvLLMDGX SparkModel OptimizerDGX Station