Inference Providers
Active filters: imatrix
MarsupialAI/Cat-Llama-3-70B-instruct_iMatrix_GGUF
71B • Updated • 93
mradermacher/Tess-2.0-Llama-3-70B-v0.2-i1-GGUF
71B • Updated • 712
mmnga/lightblue-suzume-llama-3-8B-multilingual-gguf
8B • Updated • 1.81k
• 1
mradermacher/Coomand-R-35B-v1-i1-GGUF
35B • Updated • 29
• 2
mradermacher/JSL-MedLX-70B-v3-i1-GGUF
71B • Updated • 43
mradermacher/Cat-Llama-3-70B-instruct-i1-GGUF
71B • Updated • 277
• 10
mradermacher/Palmyra-Med-70B-i1-GGUF
71B • Updated • 453
• 1
mmnga/lightblue-Karasu-Mixtral-8x22B-v0.1-gguf
141B • Updated • 752
mradermacher/Merge-Mayhem-L3-V2-i1-GGUF
8B • Updated • 340
mradermacher/Code-Llama-3-8B-i1-GGUF
8B • Updated • 630
• 1
bartowski/Code-Llama-3-8B-GGUF
Text Generation
• 8B • Updated • 408
• 9
bartowski/JSL-MedLlama-3-8B-v2.0-GGUF
Text Generation
• 8B • Updated • 342
• 7
mradermacher/Roleplay-Llama-3-8B-i1-GGUF
8B • Updated • 208
• 1
bartowski/JSL-MedLlama-3-8B-v1.0-GGUF
Text Generation
• 8B • Updated • 561
• 1
mradermacher/Llama-3-Galen-70B-v1-i1-GGUF
71B • Updated • 504
mradermacher/SynthIA-70B-v1.5-i1-GGUF
69B • Updated • 5
bartowski/llama-3-neural-chat-v2.2-8B-GGUF
Text Generation
• 8B • Updated • 434
• 5
mradermacher/l3-badger-mushroom-4x8b-i1-GGUF
25B • Updated • 32
cgus/NinjaMouse2-2.5B-v0.1-iMat-GGUF
3B • Updated • 121
• 1
mmnga/karakuri-lm-8x7b-chat-v0.1-gguf
47B • Updated • 1.14k
• 4
Clevyby/Poppy-Porpoise-0.72-L3-8B-Q5_K_S-GGUF-iMatrix
Text Generation
• 8B • Updated • 44
• 1
Clevyby/Lumimaid-8B-v0.1-OAS-Q5_K_S-GGUF-iMatrix
Text Generation
• 8B • Updated • 36
• 1
qwp4w3hyb/Llama-3-8B-Instruct-Coder-v2-iMat-GGUF
8B • Updated • 155
• 1
mradermacher/Llama-3-8B-Irene-v0.2-i1-GGUF
8B • Updated • 523
• 1
mradermacher/Lumina-5.5-Instruct-i1-GGUF
32B • Updated • 35
mradermacher/Llama-3-Aplite-Instruct-4x8B-i1-GGUF
25B • Updated • 434
bartowski/Llama-3-11.5B-Instruct-Coder-v2-GGUF
Text Generation
• 12B • Updated • 1.25k
• 9
bartowski/Meta-Llama-3-120B-Instruct-GGUF
Text Generation
• 122B • Updated • 657
• 4
lmstudio-community/Meta-Llama-3-120B-Instruct-GGUF
Text Generation
• 122B • Updated • 893
• 48
duyntnet/NexusRaven-V2-13B-imatrix-GGUF
Text Generation
• 13B • Updated • 384
• 2