YuvrajSingh9886/Qwen2.5-0.5B-grpo-summarization-quality-rouge Summarization • 0.5B • Updated about 4 hours ago • 67 • 1
HYU-NLP-EVAL/qwen3-4b-rar-medicine-static-r0-matched-seed11-step-003 Text Generation • 4B • Updated 7 days ago • 191 • 1
mradermacher/Qwen3-8B-MiMo-Music-GRPO-GGUF Reinforcement Learning • 8B • Updated 9 days ago • 743 • 1