inference-optimization/Qwen3-8B-DFlash-PerfectBlend-NVFP4-W4A4 Text Generation • 1B • Updated 3 days ago • 83
inference-optimization/Qwen3-8B-DFlash-PerfectBlend-NVFP4-W4A4 Text Generation • 1B • Updated 3 days ago • 83
inference-optimization/Qwen3-8B-DFlash-Gauss-NVFP4-W4A4 Text Generation • 1B • Updated 3 days ago • 85
inference-optimization/Qwen3-8B-DFlash-Gauss-NVFP4-W4A4 Text Generation • 1B • Updated 3 days ago • 85
inference-optimization/Qwen3-8B-DFlash-PerfectBlend-FP8-W8A8 Text Generation • 1B • Updated 3 days ago • 13
inference-optimization/Qwen3-8B-DFlash-PerfectBlend-FP8-W8A8 Text Generation • 1B • Updated 3 days ago • 13
inference-optimization/dflash-DeepSeek-V4-Flash-all-swa-muon-speculators-50k 2B • Updated Jun 27 • 46 • 2
inference-optimization/dflash-DeepSeek-V4-Flash-all-swa-muon-speculators-50k 2B • Updated Jun 27 • 46 • 2