mradermacher/Qwen3-8B-MiMo-Music-GRPO-GGUF Reinforcement Learning • 8B • Updated 14 days ago • 863 • 2
Chaew00n/test-policy-optimization-query-expansion-0529 Text Generation • 0.6B • Updated May 29, 2025 • 15 • 1
mradermacher/Poe-8B-GLM5-Opus4.6-Sonnet4.5-Kimi-Grok-Gemini-3-pro-preview-HERETIC-i1-GGUF 8B • Updated Mar 15 • 2.79k • 5
YuvrajSingh9886/Qwen2.5-0.5B-grpo-summarization-quality-rouge Summarization • 0.5B • Updated 4 days ago • 208 • 1
Sunbird/SunflowerASR-51-african-languages Automatic Speech Recognition • 2B • Updated 3 days ago • 1.91k • 25