Inference Providers
Active filters: mlx
Text Generation
• 5B • Updated • 123
impactframes/pixtral-12b-4bit
Image-Text-to-Text
• 2B • Updated • 59
mitkox/WhiteRabbitNeo-2.5-Qwen-2.5-Coder-7B-mlx
Text Generation
• 1B • Updated • 51
mlx-community/nvidia-Llama-3.1-Nemotron-70B-Reward-HF-AQ41
11B • Updated • 15
mlx-community/whisper-large-v3-turbo-q4
Updated • 6.8k
• 7
thr3a/gemma-2-baku-2b-it-mlx
3B • Updated • 7
thr3a/gemma-2-2b-jpn-it-mlx
Text Generation
• 3B • Updated • 11
mlx-community/gemma-2-2b-jpn-it
Text Generation
• 3B • Updated • 49
• 3
mlx-community/gemma-2-2b-jpn-it-8bit
Text Generation
• 0.7B • Updated • 15
• 1
mlx-community/gemma-2-2b-jpn-it-4bit
Text Generation
• 0.4B • Updated • 27
• 3
metsman/gemma-2-2b-it-4bit
Text Generation
• 0.4B • Updated • 16
mlx-community/AMD-Llama-135m
0.1B • Updated • 13
mlx-community/AMD-Llama-135m-4bit
21M • Updated • 13
mlx-community/AMD-Llama-135m-8bit
37.7M • Updated • 9
mlx-community/AMD-Llama-135m-float16
0.1B • Updated • 4
mlx-community/AMD-Llama-135m-float32
0.1B • Updated • 5
mlx-community/AMD-Llama-135m-bfloat16
0.1B • Updated • 4
mlx-community/AMD-Llama-135m-code
0.1B • Updated • 5
mlx-community/AMD-Llama-135m-code-8bit
37.7M • Updated • 5
mlx-community/AMD-Llama-135m-code-4bit
21M • Updated • 10
mlx-community/AMD-Llama-135m-code-float16
0.1B • Updated • 5
mlx-community/AMD-Llama-135m-code-float32
0.1B • Updated • 8
mlx-community/AMD-Llama-135m-code-bfloat16
0.1B • Updated • 8
mlx-community/Mistral-NeMo-Minitron-8B-Instruct
Text Generation
• 8B • Updated • 16
mlx-community/Mistral-NeMo-Minitron-8B-Instruct-8bit
Text Generation
• 2B • Updated • 26
• 1
mlx-community/Mistral-NeMo-Minitron-8B-Instruct-4bit
Text Generation
• 1B • Updated • 41
• 1
mlx-community/gemma-2-baku-2b-it
Text Generation
• 3B • Updated • 9
mlx-community/gemma-2-baku-2b-it-8bit
Text Generation
• 0.7B • Updated • 8
mlx-community/gemma-2-baku-2b-it-4bit
Text Generation
• 0.4B • Updated • 9
mlx-community/Meta-Llama-3.1-70B-Instruct-bf16-CORRECTED
Text Generation
• 71B • Updated • 138