<8B instruct models with AWQ, GPTQ quantizations available
-
Qwen/Qwen2.5-7B-Instruct
Text Generation • 8B • Updated • 10.4M • • 1.56k -
Qwen/Qwen2.5-7B-Instruct-GPTQ-Int4
Text Generation • 8B • Updated • 67.7k • 32 -
Qwen/Qwen2.5-7B-Instruct-AWQ
Text Generation • 8B • Updated • 3.83M • 51 -
meta-llama/Llama-3.2-3B-Instruct
Text Generation • 3B • Updated • 954k • • 2.46k