Inference Providers
Active filters: DPO
mradermacher/Tamil-Mistral-7B-Instruct-v0.1-i1-GGUF
7B • Updated • 59
itlwas/Hermes-2-Pro-Llama-3-8B-Q4_K_M-GGUF
8B • Updated • 58
itlwas/Hermes-2-Pro-Mistral-7B-Q4_K_M-GGUF
7B • Updated • 22
tensorblock/Truthful_DPO_MOE_19B-GGUF
19B • Updated • 35
tensorblock/Truthful_DPO_TomGrc_FusionNet_34Bx2_MoE-GGUF
61B • Updated • 33
tensorblock/Yi-34Bx2-MoE-60B-DPO-GGUF
61B • Updated • 38
tensorblock/Nous-Hermes-2-Mixtral-8x7B-DPO-GGUF
47B • Updated • 55
Model-SafeTensors/Llama3-OpenBioLLM-70B
Izhanjafry/Nous-Hermes-2-Mistral-7B-DPO-Q4_0-GGUF
7B • Updated • 29
Text Generation
• 8B • Updated • 13
Novaciano/TinyLlama-1b_DPO_Roleplay_NSFW-GGUF
1B • Updated • 122
• 3
tensorblock/Hermes-2-Theta-Llama-3-8B-32k-GGUF
mradermacher/Llama3-OpenBioLLM-8B-i1-GGUF
8B • Updated • 204
• 1
MilyaShams/SmolLM2-DPO-FT-smoltalk
Text Generation
• 0.1B • Updated • 9
MilyaShams/SmolLM2-DPO-FT-Instruct
Text Generation
• 0.1B • Updated • 6
Avibhi/Gemma2-2B-HindiTranslation-DPO
Updated
JHuel/Mistral-Nemo-Instruct-2407_DPO_qlora
Reinforcement Learning
• Updated Text Generation
• 8B • Updated • 16
• • 4
mradermacher/Karasu-DPO-7B-GGUF
8B • Updated • 263
• 1
mradermacher/Karasu-DPO-7B-i1-GGUF
8B • Updated • 229
• 1
govindrhf/aaditya-Llama3-OpenBioLLM-70B
dhruvrnaik/test-openbiollm
mlx-community/DiscoLM_German_7b_v1-mlx
7B • Updated • 19
• 1
chucre/Llama3-OpenBioLLM-70B
jachermann/DiscoLM_German_7b_v1_court_finetuned
7B • Updated • 13
VaidikML0508/Shark-Tank-Offer-Evaluator-llama3.2-3B-Instruct-SFT-DPO-4bits-V1
Text Generation
• 3B • Updated • 5
Writer/Palmyra-local-1_7B
2B • Updated • 1
estnafinema0/smolLM-variation-dpo
Text Generation
• 0.1B • Updated • 7
mradermacher/KoBioMed-Llama-3.1-8B-Instruct-GGUF
8B • Updated • 197
mradermacher/KoBioMed-Llama-3.1-8B-Instruct-i1-GGUF
8B • Updated • 485