Buckets:
772 MB
11 files
Updated 8 days ago
Ctrl+K
| Name | Size | Uploaded | Xet hash |
|---|---|---|---|
| .gitattributes | 1.57 kB xet | aacf151a | |
| README.md | 1.17 kB xet | b5e74ed3 | |
| added_tokens.json | 35 Bytes xet | c49aaa18 | |
| config.json | 1.1 kB xet | f29d6afc | |
| model.safetensors | 733 MB xet | 9b9834a6 | |
| model.safetensors.index.json | 50.5 kB xet | bf72ff00 | |
| preprocessor_config.json | 570 Bytes xet | 315e627d | |
| special_tokens_map.json | 662 Bytes xet | 02a534c8 | |
| tokenizer.json | 33.4 MB xet | fa66c8c0 | |
| tokenizer.model | 4.69 MB xet | a81fa217 | |
| tokenizer_config.json | 1.16 MB xet | f2cdde5b |
mlx-community/gemma-3-1b-it-4bit
The Model mlx-community/gemma-3-1b-it-4bit was converted to MLX format from google/gemma-3-1b-it using mlx-lm version 0.21.6.
Use with mlx
pip install mlx-lm
from mlx_lm import load, generate
model, tokenizer = load("mlx-community/gemma-3-1b-it-4bit")
prompt = "hello"
if tokenizer.chat_template is not None:
messages = [{"role": "user", "content": prompt}]
prompt = tokenizer.apply_chat_template(
messages, add_generation_prompt=True
)
response = generate(model, tokenizer, prompt=prompt, verbose=True)
- Total size
- 772 MB
- Files
- 11
- Last updated
- Aug 2
- Pre-warmed CDN
- US EU US EU