shawnzzzzz/Qwen3-30B-A3B-GRPO-W4A4-NoOverlong-Step800 Reinforcement Learning • 31B • Updated 4 days ago • 66
shawnzzzzz/Qwen3-30B-A3B-GRPO-LowPrecision-Control-Step410 Text Generation • 31B • Updated 17 days ago • 141
shawnzzzzz/Qwen3-30B-A3B-DAPO-FFN-W4A4-QAT-BF16Master-step-0815 Text Generation • 31B • Updated Jul 12 • 170
shawnzzzzz/Qwen3-30B-A3B-DAPO-FFN-W4A4-QAT-BF16Master-step-0730 Text Generation • 31B • Updated Jul 12 • 163
shawnzzzzz/Qwen3-30B-A3B-DAPO-FFN-W4A4-QAT-BF16Master-step-0620 Text Generation • 31B • Updated Jul 12 • 155
shawnzzzzz/Qwen3-30B-A3B-DAPO-FFN-W4A4-QAT-BF16Master-step-0475 Text Generation • 31B • Updated Jul 12 • 146
shawnzzzzz/Qwen3-30B-A3B-DAPO-FFN-W4A4-QAT-BF16Master-step-0330 Text Generation • 31B • Updated Jul 12 • 117
shawnzzzzz/Qwen3-30B-A3B-DAPO-FFN-W4A4-QAT-BF16Master-step-0195 Text Generation • 31B • Updated Jul 12 • 102
shawnzzzzz/Qwen3-30B-A3B-DAPO-FFN-W4A4-QAT-BF16Master-step-0060 Text Generation • 31B • Updated Jul 12 • 140