inference-optimization/Qwen3-30B-A3B-Thinking-2507-REAP-25-nonuniform Text Generation • 23B • Updated 12 minutes ago
inference-optimization/Qwen3-30B-A3B-Thinking-2507-REAP-25-uniform Text Generation • 23B • Updated 19 minutes ago
inference-optimization/qwen3.8-27B-speculator.dflash2.comparisonrecipe.v2.epoch1_end 2B • Updated about 8 hours ago
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.bs8.ckp0 3B • Updated 1 day ago • 13
inference-optimization/Qwen3.8-27B-DSpark-GPTQ-IMatrix-PerfectBlend-NVFP4-W4A4 Text Generation • 2B • Updated 1 day ago • 18
inference-optimization/Qwen3.8-27B-DSpark-GPTQ-IMatrix-Gauss-NVFP4-W4A4 Text Generation • 2B • Updated 1 day ago • 18
inference-optimization/Qwen3.8-27B-DSpark-GPTQ-PerfectBlend-NVFP4-W4A4 Text Generation • 2B • Updated 1 day ago • 16
inference-optimization/Qwen3.8-27B-DSpark-GPTQ-Gauss-NVFP4-W4A4 Text Generation • 2B • Updated 1 day ago • 18
inference-optimization/Qwen3.8-27B-DSpark-PerfectBlend-NVFP4-W4A4 Text Generation • 2B • Updated 1 day ago • 125
inference-optimization/Qwen3.8-27B-DSpark-Gauss-NVFP4-W4A4 Text Generation • 2B • Updated 1 day ago • 126
inference-optimization/Qwen3.8-27B-DSpark-PerfectBlend-FP8-W8A8 Text Generation • 2B • Updated 1 day ago • 20
inference-optimization/Qwen3.8-27B-DSpark-Gauss-FP8-W8A8 Text Generation • 2B • Updated 1 day ago • 19
inference-optimization/qwen3.8-27B-speculator.dflash2.comparisonrecipe.v2.epoch1_step107505 2B • Updated 1 day ago • 18
inference-optimization/Qwen3-8B-DFlash-GPTQ-IMatrix-PerfectBlend-NVFP4-W4A4 Text Generation • 1B • Updated 1 day ago • 21
inference-optimization/Qwen3-8B-DFlash-GPTQ-IMatrix-Gauss-NVFP4-W4A4 Text Generation • 1B • Updated 1 day ago • 19
inference-optimization/Qwen3-8B-DFlash-GPTQ-PerfectBlend-NVFP4-W4A4 Text Generation • 1B • Updated 1 day ago • 17
inference-optimization/Qwen3-8B-DFlash-GPTQ-Gauss-NVFP4-W4A4 Text Generation • 1B • Updated 1 day ago • 18
inference-optimization/qwen3.8-27B-speculator.dflash2.comparisonrecipe.epoch1_step93171 2B • Updated 4 days ago • 39
inference-optimization/Qwen3-8B-DFlash-PerfectBlend-NVFP4-W4A4 Text Generation • 1B • Updated 5 days ago • 92
inference-optimization/Qwen3-8B-DFlash-Gauss-NVFP4-W4A4 Text Generation • 1B • Updated 5 days ago • 95
inference-optimization/Qwen3-8B-DFlash-PerfectBlend-FP8-W8A8 Text Generation • 1B • Updated 5 days ago • 20