Inference Providers
Active filters: quark
fxmarty/qwen1.5_moe_a2.7b_chat_w_fp6_e2m3_a_fp6_e2m3
11B • Updated • 12
fxmarty/qwen1.5_moe_a2.7b_chat_w_fp6_e3m2_a_fp6_e3m2
11B • Updated • 7.39k
amd/Llama-2-70b-chat-hf-WMXFP4-AMXFP4-KVFP8-Scale-UINT8-MLPerf-GPTQ
37B • Updated • 16
sudhab1988/rakuten-7b-awq-g128-int4-asym-fp16-hf
1B • Updated • 4
matmelis/Llama_3.2_1B_w_uint4_gptq
0.4B • Updated • 7
EliovpAI/Qwen3-14B-FP8-KV
Text Generation
• 15B • Updated • 18
• 2
matmelis/Llama_3.2_1B_w_uint4_autosmoothquant_gptq
0.4B • Updated • 5
matmelis/Llama_3.2_1B_w_uint4_qronos
0.4B • Updated • 3
matmelis/Llama_3.2_3B_w_mxfp4_a_mxfp4_qronos
2B • Updated • 4
EliovpAI/Qwen3-0.6B-FP8-KV
Text Generation
• 0.6B • Updated • 27
matmelis/Llama_3.2_3B_w_mxfp4_a_mxfp4_gptq
2B • Updated • 4
matmelis/Llama_3.2_1B_w_int3_qronos
0.6B • Updated • 5
matmelis/Llama_3.2_3B_w_uint4_qronos
0.8B • Updated • 4
matmelis/Llama_3.2_3B_w_int3_qronos
1B • Updated • 6
matmelis/Llama_3.2_3B_w_int2_gptq
3B • Updated • 5
matmelis/Llama_3.2_3B_w_int3_gptq
3B • Updated • 4
matmelis/Llama_3.2_3B_w_int2_qronos
3B • Updated • 4
matmelis/Llama_3.2_1B_w_int3_gptq
0.6B • Updated • 6
matmelis/Llama_3.2_3B_w_uint4_gptq
0.8B • Updated • 5
matmelis/Llama_3.2_1B_w_int2_qronos
1B • Updated • 3
matmelis/Llama_3.2_1B_w_int2_gptq
1B • Updated • 5
matmelis/Llama_3.2_1B_w_uint4_smoothquant_qronos
0.4B • Updated • 7
amd/DeepSeek-R1-0528-MXFP4-ASQ
342B • Updated • 748
• 1
haoyang-amd/output_oss_120b_moe_w_mxfp4_a_mxfp4
174B • Updated • 5
haoyang-amd/output_oss_20b_moe_w_mxfp4_a_bfloat16
11B • Updated • 4
matmelis/Llama_3.2_1B_w_mxfp4_a_mxfp4_gptq
0.8B • Updated • 5
matmelis/Llama_3.2_1B_w_mxfp4_a_mxfp4_qronos
0.8B • Updated • 7
amd/Mixtral-8x7B-Instruct-v0.1-WMXFP4FP8-AMXFP4FP8-AMP-KVFP8
37B • Updated • 17
amd/Llama-2-70b-chat-hf-WMXFP4FP8-AMXFP4FP8-AMP-KVFP8
55B • Updated • 23
Keozon/GLM-4.5-Air-fp8_e4m3-quark-gfx1100
107B • Updated • 17
• 1