Inference Providers
Active filters: imatrix
bartowski/Qwen_Qwen3-Next-80B-A3B-Thinking-GGUF
Text Generation
• 80B • Updated • 111k
• 16
mradermacher/PromptEnhancer-32B-i1-GGUF
Text-to-Image
• 33B • Updated • 385
• 1
neuphonic/neutts-air-q8-gguf
Text-to-Speech
• 0.7B • Updated • 57k
• 43
mradermacher/PromptEnhancer-Img2img-Edit-i1-GGUF
Text-to-Image
• 33B • Updated • 2.44k
• 1
mradermacher/WilR-mini-i1-GGUF
4B • Updated • 1.55k
• 1
redponike/Ling-mini-2.0-GGUF-ik
Text Generation
• 16B • Updated • 233
• 2
mradermacher/Luau-Qwen3-4B-FIM-v0.1-i1-GGUF
4B • Updated • 194
• 2
bartowski/cerebras_GLM-4.5-Air-REAP-82B-A12B-GGUF
Text Generation
• 85B • Updated • 1.7k
• 44
noctrex/Huihui-Qwen3-VL-30B-A3B-Instruct-abliterated-GGUF
Image-Text-to-Text
• 31B • Updated • 45.3k
• 30
unsloth/Qwen3-VL-30B-A3B-Thinking-GGUF
Image-Text-to-Text
• 31B • Updated • 40.6k
• 42
unsloth/Qwen3-VL-30B-A3B-Instruct-GGUF
Image-Text-to-Text
• 31B • Updated • 115k
• 108
mradermacher/Qwen3-30B-A3B-Thinking-2507-Claude-4.5-Sonnet-High-Reasoning-Distill-i1-GGUF
31B • Updated • 2.46k
• 6
DavidAU/OpenAi-GPT-oss-20b-HERETIC-uncensored-NEO-Imatrix-gguf
Text Generation
• 21B • Updated • 23.6k
• 172
mradermacher/GAD-GPT-5-Chat-Qwen2.5-7B-Instruct-i1-GGUF
8B • Updated • 1.31k
• 1
mradermacher/Big-Tiger-Gemma-27B-v3-heretic-i1-GGUF
27B • Updated • 720
• 5
unsloth/Qwen3-Next-80B-A3B-Instruct-GGUF
Text Generation
• 80B • Updated • 29.8k
• 195
unsloth/Qwen3-Next-80B-A3B-Thinking-GGUF
Text Generation
• 80B • Updated • 14.2k
• 80
ReadyArt/GLM-4.6-Derestricted-GGUF
357B • Updated • 5.7k
• 27
neuphonic/neutts-nano-q4-gguf
Text-to-Speech
• 0.2B • Updated • 2.2k
• 16
neuphonic/neutts-nano-q8-gguf
Text-to-Speech
• 0.2B • Updated • 654
• 24
unsloth/Devstral-2-123B-Instruct-2512-GGUF
125B • Updated • 3.63k
• 56
unsloth/Nemotron-3-Nano-30B-A3B-GGUF
Text Generation
• 32B • Updated • 15.8k
• 328
ServiceNow-AI/Apriel-1.6-15b-Thinker-GGUF
14B • Updated • 236
• 16
mradermacher/Huihui-Qwen3-Next-80B-A3B-Thinking-abliterated-i1-GGUF
80B • Updated • 1.15k
• 3
Text Generation
• 358B • Updated • 5.64k
• 223
llmware/qwen2.5-vl-3b-instruct-gguf
3B • Updated • 1.16k
• 1
mradermacher/Llama3.3-8B-Instruct-Thinking-Heretic-Uncensored-Claude-4.5-Opus-High-Reasoning-i1-GGUF
8B • Updated • 87.7k
• 75
mradermacher/Heretic-Nemotron-Content-Safety-Reasoning-4B-i1-GGUF
4B • Updated • 1.75k
• 2
mradermacher/LlamaForecaster-8B-i1-GGUF
Question Answering
• 8B • Updated • 837
• 4
Text Generation
• 0.5B • Updated • 311
• 1