inference-optimization/Qwen3-8B-DFlash-GPTQ-PerfectBlend-NVFP4-W4A4 Text Generation • 1B • Updated 14 days ago • 47
inference-optimization/Qwen3-8B-DFlash-GPTQ-Gauss-NVFP4-W4A4 Text Generation • 1B • Updated 14 days ago • 48
inference-optimization/qwen3.8-27B-speculator.dflash2.comparisonrecipe.epoch1_step93171 2B • Updated 16 days ago • 76
inference-optimization/Qwen3-8B-DFlash-PerfectBlend-NVFP4-W4A4 Text Generation • 1B • Updated 17 days ago • 124
inference-optimization/Qwen3-8B-DFlash-Gauss-NVFP4-W4A4 Text Generation • 1B • Updated 17 days ago • 129
inference-optimization/Qwen3-8B-DFlash-PerfectBlend-FP8-W8A8 Text Generation • 1B • Updated 17 days ago • 37
inference-optimization/Qwen3-8B-DFlash-Gauss-FP8-W8A8 Text Generation • 1B • Updated 17 days ago • 39
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp4 3B • Updated 25 days ago • 61
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp3 3B • Updated 25 days ago • 52
inference-optimization/Qwen3-8B-speculator.dflash2.v1.fullvocab.muon.dpace-preresume-epoch2 2B • Updated 26 days ago • 44
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp2 3B • Updated 27 days ago • 51
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp1 3B • Updated 27 days ago • 45
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp0 3B • Updated 27 days ago • 47
inference-optimization/Qwen3.8-Flash-Next-0.2B-A0.2B Image-Text-to-Text • 0.2B • Updated 27 days ago • 1.24k • 2