mradermacher/Reflector-Internalizing-Safety-Llama-3.1-8B-RL-GGUF Reinforcement Learning • 8B • Updated Jun 26 • 18 • 1
mradermacher/Reflector-Internalizing-Safety-Llama-3.1-8B-RL-i1-GGUF Reinforcement Learning • 8B • Updated Jun 26 • 350 • 1