roshniramesh 's Collections int4 llm
updated
Text Generation
• Updated • 26
• 1
nvidia/Gemma-2b-it-ONNX-INT4
nvidia/Meta-Llama-3.1-8B-Instruct-ONNX-INT4
Updated • 122
• 9
nvidia/Meta-Llama-3.2-3B-Instruct-ONNX-INT4
nvidia/Phi-3.5-mini-Instruct-ONNX-INT4
nvidia/Mistral-Nemo-12B-Instruct-ONNX-INT4
nvidia/Nemotron-Mini-4B-Instruct-ONNX-INT4
meta-llama/Llama-3.2-1B-Instruct-SpinQuant_INT4_EO8
Text Generation
• Updated • 153
• 41
hugging-quants/gemma-2-9b-it-AWQ-INT4
Text Generation
• 9B • Updated • 5.86k
• 10
Qwen/Qwen2-7B-Instruct-GPTQ-Int4
Text Generation
• 8B • Updated • 405
• 28
hugging-quants/Meta-Llama-3.1-8B-Instruct-AWQ-INT4
Text Generation
• 8B • Updated • 115k
• 93
RedHatAI/Meta-Llama-3.1-8B-Instruct-quantized.w4a16
Text Generation
• 8B • Updated • 41.5k
• 30
ModelCloud/Meta-Llama-3.1-8B-gptq-4bit
Text Generation
• 8B • Updated • 62
hugging-quants/Llama-3.2-3B-Instruct-Q4_K_M-GGUF
Text Generation
• 3B • Updated • 36.7k
• 48
hugging-quants/Meta-Llama-3.1-70B-Instruct-AWQ-INT4
Text Generation
• 71B • Updated • 160k
• 111
hugging-quants/Llama-3.2-1B-Instruct-Q4_K_M-GGUF
Text Generation
• 1B • Updated • 54.1k
• 33
hugging-quants/Meta-Llama-3.1-70B-Instruct-GPTQ-INT4
Text Generation
• 71B • Updated • 364
• 23
hugging-quants/Meta-Llama-3.1-8B-Instruct-GPTQ-INT4
Text Generation
• 8B • Updated • 8.76k
• 42
meta-llama/Llama-Guard-3-1B-INT4
Text Generation
• Updated • 13
• 31
meta-llama/Llama-3.2-3B-Instruct-QLORA_INT4_EO8
Text Generation
• Updated • 118
• 76
meta-llama/Llama-3.2-3B-Instruct-SpinQuant_INT4_EO8
Text Generation
• Updated • 148
• 40
meta-llama/Llama-3.2-1B-Instruct-QLORA_INT4_EO8
Text Generation
• Updated • 126
• 49
RedHatAI/Mistral-7B-Instruct-v0.3-GPTQ-4bit
Text Generation
• 7B • Updated • 1.04k
• 25
RedHatAI/Mistral-7B-Instruct-v0.3-quantized.w4a16
Text Generation
• 7B • Updated • 213
• 2
RedHatAI/Llama-2-7b-chat-quantized.w4a16
Text Generation
• 7B • Updated • 33
RedHatAI/Meta-Llama-3-8B-Instruct-quantized.w4a16
Text Generation
• 8B • Updated • 84
• 2
RedHatAI/Meta-Llama-3-70B-Instruct-quantized.w4a16
Text Generation
• 71B • Updated • 31
• 2
RedHatAI/gemma-2-2b-it-quantized.w4a16
Text Generation
• 3B • Updated • 504
• 1
RedHatAI/gemma-2-9b-it-quantized.w4a16
Text Generation
• 10B • Updated • 102
• 2
RedHatAI/Mistral-Nemo-Instruct-2407-quantized.w4a16
Text Generation
• 12B • Updated • 1.16k
• 4
RedHatAI/Meta-Llama-3.1-70B-Instruct-quantized.w4a16
Text Generation
• 71B • Updated • 8.16k
• 33
nvidia/Mistral-7B-Instruct-v0.3-ONNX-INT4
OpenVINO/mistral-7b-instruct-v0.1-int4-ov
Text Generation
• Updated • 84
• 1
OpenVINO/Mistral-7B-Instruct-v0.2-int4-ov
Text Generation
• Updated • 213
• 1
Text Generation
• 72B • Updated • 245
• 47
Text Generation
• 14B • Updated • 372
• 101
Text Generation
• 8B • Updated • 416
• 75
Text Generation
• 2B • Updated • 359
• 36
Qwen/Qwen1.5-110B-Chat-GPTQ-Int4
Text Generation
• 111B • Updated • 133
• 19
Qwen/Qwen1.5-1.8B-Chat-GPTQ-Int4
Text Generation
• 2B • Updated • 1.2k
• 7
Qwen/Qwen1.5-MoE-A2.7B-Chat-GPTQ-Int4
Text Generation
• 14B • Updated • 1.23k
• 50
Qwen/Qwen1.5-4B-Chat-GPTQ-Int4
Text Generation
• 4B • Updated • 1.72k
• 7
Qwen/Qwen1.5-72B-Chat-GPTQ-Int4
Text Generation
• 72B • Updated • 3.87k
• 37
Qwen/Qwen1.5-4B-Chat-GGUF
Text Generation
• 4B • Updated • 930
• 16
Qwen/Qwen1.5-0.5B-Chat-GGUF
Text Generation
• 0.6B • Updated • 10.2k
• 37
Qwen/Qwen1.5-7B-Chat-GGUF
Text Generation
• 8B • Updated • 12.5k
• 71
Qwen/CodeQwen1.5-7B-Chat-GGUF
Text Generation
• 7B • Updated • 1.15k
• 111
Qwen/Qwen2.5-1.5B-Instruct-GPTQ-Int4
Text Generation
• 2B • Updated • 2.96k
• 3
Qwen/Qwen2.5-0.5B-Instruct-GPTQ-Int4
Text Generation
• 0.5B • Updated • 1.05k
• 9
Qwen/Qwen2.5-0.5B-Instruct-GGUF
Text Generation
• 0.6B • Updated • 242k
• 142
Qwen/Qwen2-1.5B-Instruct-GGUF
Text Generation
• 2B • Updated • 22.1k
• 33
Qwen/Qwen2-0.5B-Instruct-GGUF
Text Generation
• 0.5B • Updated • 13.1k
• 77
Qwen/Qwen2-7B-Instruct-GGUF
Text Generation
• 8B • Updated • 4.34k
• 180
Qwen/Qwen2-0.5B-Instruct-GPTQ-Int4
Text Generation
• 0.6B • Updated • 388
• 16
Qwen/Qwen2-1.5B-Instruct-GPTQ-Int4
Text Generation
• 2B • Updated • 3.4k
• 6
Qwen/Qwen2-72B-Instruct-GPTQ-Int4
Text Generation
• 73B • Updated • 146
• 33
Qwen/Qwen2-57B-A14B-Instruct-GPTQ-Int4
Text Generation
• 57B • Updated • 276
• 23