Inference Providers
Active filters: int8
minpeter/anthracite-org-magnum-v4-72b-fmo-int8
73B • Updated • 4
SteveTran/T5-small-query-expansion-INT8
Text Generation
• Updated • 5
• 2
Text Generation
• 0.1B • Updated • 186
• 3
mradermacher/ecastera-eva-westlake-7b-spanish-GGUF
7B • Updated • 161
RedHatAI/Llama-3.1-Nemotron-70B-Instruct-HF-quantized.w8a8
Text Generation
• 71B • Updated • 30
RedHatAI/QwQ-32B-Preview-quantized.w8a8
Text Generation
• 33B • Updated • 25
NeoChen1024/Dolphin3.0-Llama3.1-8B-W8A8
8B • Updated • 18
NeoChen1024/dolphin-2.9.3-mistral-7B-32k-W8A8
7B • Updated • 12
RedHatAI/granite-3.1-8b-instruct-quantized.w8a8
Text Generation
• 8B • Updated • 662
• 2
RedHatAI/granite-3.1-2b-instruct-quantized.w8a8
Text Generation
• 3B • Updated • 56
RedHatAI/granite-3.1-2b-base-quantized.w8a8
Text Generation
• 3B • Updated • 39
RedHatAI/granite-3.1-8b-base-quantized.w8a8
Text Generation
• 8B • Updated • 37
NeoChen1024/Ministral-8B-Instruct-2410-W8A8
8B • Updated • 13
• 2
RedHatAI/Llama-3.3-70B-Instruct-quantized.w8a8
Text Generation
• 71B • Updated • 4.12k
• 14
RedHatAI/DeepSeek-R1-Distill-Llama-8B-quantized.w8a8
Text Generation
• 8B • Updated • 515
• 2
RedHatAI/DeepSeek-R1-Distill-Llama-70B-quantized.w8a8
Text Generation
• 71B • Updated • 527
• 2
RedHatAI/DeepSeek-R1-Distill-Qwen-14B-quantized.w8a8
Text Generation
• 15B • Updated • 405
• 2
RedHatAI/DeepSeek-R1-Distill-Qwen-32B-quantized.w8a8
Text Generation
• 33B • Updated • 520
• 13
RedHatAI/DeepSeek-R1-Distill-Qwen-7B-quantized.w8a8
Text Generation
• 8B • Updated • 464
• 5
RedHatAI/DeepSeek-R1-Distill-Qwen-1.5B-quantized.w8a8
Text Generation
• 2B • Updated • 119
• 2
RedHatAI/Pixtral-Large-Instruct-2411-hf-quantized.w8a8
Image-Text-to-Text
• 124B • Updated • 32
ospatch/QwQ-32B-INT8-W8A8
Text Generation
• 33B • Updated • 15
• 5
labaispeak/stable-diffusion-2-1-openvino-int8
Text-to-Image
• Updated • 1
ConfidentialMind/gte-multilingual-reranker-base-onnx-op14-opt-gpu-int8
Sentence Similarity
• Updated • 4
• 1
QuantTrio/Qwen3-235B-A22B-GPTQ-Int8
Text Generation
• 235B • Updated • 18
Gapeleon/bytedance_BAGEL-7B-MoT-INT8
Any-to-Any
• Updated • 19
• 24
sfrontull/transloco-ita-lld
Translation
• Updated • 27
mr-abhisharma/AceNemotron-14B-Quantize-8bit
Text Generation
• 15B • Updated • 12
DESUCLUB/Llama-3.1-8B-Instruct-quantized.w8a8
Text Generation
• 8B • Updated • 14
DESUCLUB/Llama-3.1-8B-Instruct-bf16-quantized.w8a8
Text Generation
• 8B • Updated • 14