Inference Providers
Active filters: int8
RedHatAI/gemma-2-9b-it-quantized.w8a16
Text Generation
• 10B • Updated • 413
• 1
RedHatAI/gemma-2-2b-it-quantized.w8a16
Text Generation
• 3B • Updated • 28
• 1
RedHatAI/gemma-2-2b-quantized.w8a16
Text Generation
• 3B • Updated • 42
RedHatAI/SmolLM-1.7B-Instruct-quantized.w8a16
Text Generation
• 2B • Updated • 28
RedHatAI/gemma-2-2b-it-quantized.w8a8
Text Generation
• 3B • Updated • 26
RedHatAI/gemma-2-9b-it-quantized.w8a8
Text Generation
• 10B • Updated • 47
• 2
angeloc1/llama3dot1FoodDel8v02
Text Generation
• 8B • Updated • 6
RedHatAI/Meta-Llama-3.1-405B-Instruct-quantized.w8a8
Text Generation
• 406B • Updated • 27
• 2
RedHatAI/Meta-Llama-3.1-405B-Instruct-quantized.w8a16
Text Generation
• 406B • Updated • 25
• 1
RedHatAI/gemma-2-27b-it-quantized.w8a16
Text Generation
• 28B • Updated • 28
RedHatAI/SmolLM-135M-Instruct-quantized.w8a16
Text Generation
• 0.2B • Updated • 351
RedHatAI/SmolLM-360M-Instruct-quantized.w8a8
Text Generation
• 0.4B • Updated • 24
RedHatAI/SmolLM-135M-Instruct-quantized.w8a8
Text Generation
• 0.2B • Updated • 22
• 1
RedHatAI/SmolLM-1.7B-Instruct-quantized.w8a8
Text Generation
• 2B • Updated • 34
• 1
zzzmahesh/Meta-Llama-3-8B-Instruct-quantized.w8a8
Text Generation
• 8B • Updated • 12
FriendliAI/Meta-Llama-3.1-8B-Instruct-int8
Text Generation
• 8B • Updated • 16.3k
• 1
FriendliAI/Meta-Llama-3.1-70B-Instruct-int8
Text Generation
• 71B • Updated • 13
RedHatAI/Qwen2.5-7B-Instruct-quantized.w8a8
Text Generation
• 8B • Updated • 1.17k
• 2
RedHatAI/Qwen2.5-0.5B-quantized.w8a16
Text Generation
• 0.6B • Updated • 625
RedHatAI/Qwen2.5-1.5B-quantized.w8a16
Text Generation
• 2B • Updated • 82
RedHatAI/Qwen2.5-3B-quantized.w8a16
Text Generation
• 3B • Updated • 108
RedHatAI/Qwen2.5-7B-quantized.w8a16
Text Generation
• 8B • Updated • 138
• 1
RedHatAI/Qwen2.5-32B-quantized.w8a16
Text Generation
• 33B • Updated • 41
RedHatAI/Qwen2.5-72B-quantized.w8a16
Text Generation
• 73B • Updated • 19
avans06/Meta-Llama-3.1-8B-Instruct-ct2-int8_float16
Text Generation
• Updated • 10
avans06/Meta-Llama-3.2-8B-Instruct-ct2-int8_float16
Text Generation
• Updated • 19
minpeter/Qwen-Qwen2.5-14B-Instruct-fmo-int8
15B • Updated • 2
minpeter/Qwen-Qwen2.5-32B-Instruct-fmo-int8
33B • Updated • 6
minpeter/anthracite-org-magnum-v4-72b-fmo-int8
73B • Updated • 4
SteveTran/T5-small-query-expansion-INT8
Text Generation
• Updated • 5
• 2