inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp4 3B • Updated 6 days ago • 32
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp3 3B • Updated 6 days ago • 24
inference-optimization/Qwen3-8B-speculator.dflash2.v1.fullvocab.muon.dpace-preresume-epoch2 2B • Updated 7 days ago • 18
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp2 3B • Updated 7 days ago • 27
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp1 3B • Updated 7 days ago • 24
inference-optimization/gemma-4-31B-it-speculator.dflash.latestrecipe.ckp0 3B • Updated 7 days ago • 19
inference-optimization/Qwen3.8-Flash-Next-0.2B-A0.2B Image-Text-to-Text • 0.2B • Updated 8 days ago • 980 • 2
inference-optimization/Qwen3-8B-speculator.dspark.swa.gammatv.2048anc.muon.regencollection.selfdistill-v3-epoch2 2B • Updated 20 days ago • 62
inference-optimization/Qwen3-8B-speculator.dspark.swa.gammatv.2048anc.muon.regencollection.selfdistill-v3-epoch1 2B • Updated 20 days ago • 44
inference-optimization/Qwen3-8B-speculator.dspark.swa.gammatv.2048anc.muon.regencollection.selfdistill-v3-epoch0 2B • Updated 20 days ago • 49
inference-optimization/Qwen3-8B-speculator.dflash.swa.dpace.fullvocab.muon.1536anc.nemotron.v2v3-v8-ckpt19 2B • Updated 21 days ago • 44
inference-optimization/Nemotron-3.5-Lightning-1.4B-A0.1B-MTP Text Generation • 1B • Updated 22 days ago • 723 • 1
inference-optimization/GLM-5.3-Flash-0.1B-A0.1B Image-Text-to-Text • 84.4M • Updated 22 days ago • 1.31k • 3