NousResearch/DeepHermes-AscensionMaze-RLAIF-8b-Atropos Reinforcement Learning • 8B • Updated Apr 29, 2025 • 72 • 10
NousResearch/DeepHermes-AscensionMaze-RLAIF-8b-Atropos-GGUF Reinforcement Learning • 127k • Updated May 10, 2025 • 125 • 9
mradermacher/Hemlock-Apothecary-7B-GRPO-e3-GGUF Reinforcement Learning • 8B • Updated 27 days ago • 598 • 1
mradermacher/Hemlock2-Coder-7B-GRPO-GGUF Reinforcement Learning • 8B • Updated 27 days ago • 1.17k • 1
mradermacher/Hemlock-Apothecary-7B-GRPO-e3-i1-GGUF Reinforcement Learning • 8B • Updated 27 days ago • 2.94k • 1
mradermacher/Hemlock2-Coder-7B-GRPO-i1-GGUF Reinforcement Learning • 8B • Updated 27 days ago • 1.98k • 1
ValueFX9507/Tifa-Deepsex-14b-CoT-GGUF-Q4 Reinforcement Learning • 15B • Updated Feb 13, 2025 • 2.02k • 847