Instructions to use Azimml/Qwen3-8B-trellis-3bit-webgpu with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use Azimml/Qwen3-8B-trellis-3bit-webgpu with Transformers:
# Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("Azimml/Qwen3-8B-trellis-3bit-webgpu", device_map="auto") - Notebooks
- Google Colab
- Kaggle
File size: 245 Bytes
672e862 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 | {
"hidden_size": 4096,
"intermediate_size": 12288,
"num_layers": 36,
"n_heads": 32,
"n_kv_heads": 8,
"head_dim": 128,
"vocab_size": 151936,
"rope_theta": 1000000.0,
"rms_eps": 1e-06,
"tie_embeddings": false,
"qk_norm": true,
"K": 3
} |