Inference Providers
Active filters: trl
constion97/llama7b-4bit-unslothed1
Text Generation
• 7B • Updated • 7
constion97/mistral7b-4bit-unslothed1
Text Generation
• 7B • Updated • 7
constion97/mistral7b-16bit-unslothed1
Text Generation
• 7B • Updated • 6
WL2928/zephyr-7b-dpo-qlora
Text Generation
• 1B • Updated • 6
• Garvitk/open-aditi_alpaca_dolly
Text Generation
• 7B • Updated yzhuang/TinyLlama-1.1B_fictional_v3
Text Generation
• 1B • Updated • 5
• Holarissun/gemma2b-airl_sft-tldr-seqsampler
Holarissun/gemma2b-airl_sft-tldr-randsampler
gjonesQ02/WO_PlanningAssistantConvo_A
tsavage68/mistralit2_1000_STEPS_1e7_rate_0.1_beta_DPO
Text Generation
• 7B • Updated • 7
tsavage68/mistralit2_1000_STEPS_1e6_05_beta_DPO
Text Generation
• 7B • Updated • 6
tsavage68/mistralit2_1000_STEPS_rate_1e6_03_Beta_DPO
Text Generation
• 7B • Updated • 6
taoki/gemma-2b-it-qlora-amenokaku-code
Feature Extraction
• 3B • Updated • 10
kanxxyc/gemma-2b-japaneseQA-instruct
Updated • 5
• 1
davidhaas6/chats-XmlUser_NoPrefix-mistral7b-4bit
Text Generation
• Updated • 5
Holarissun/zephyr3b-airl_sft-tldr-seqsampler
DarshanDeshpande/distilbert_social_reasoning_reward_model
Text Classification
• 67M • Updated • 9
Holarissun/zephyr3b-airl_sft-tldr-randsampler
bibekyess/solar-checkpoint-2000
mervinpraison/tamil-gemma-7b-praison-v1.0
Updated • 11
David-Xu/cira-7b-dpo-lora
tsavage68/mistralit2_250_STEPS_1e7_rate_0.1_beta_DPO
Text Generation
• 7B • Updated • 5
NobodyExistsOnTheInternet/mistral-7b-base-dpo-run
Updated • 4
• 1
mervinpraison/tamil-large-language-model-7b-v1.0
Text Generation
• 9B • Updated • 23
• 7
mashinaalive/zephyr-7b-sft-qlora
Guyvdb/tinyllama-colorist-lora
tsavage68/mistralit2_1000_STEPS_1e7_rate_03_beta_DPO
Text Generation
• 7B • Updated • 5
JoniJoniAl/diversetraining10maart
Updated