Instructions to use Azimml/Qwen3-1.7B-trellis-3bit-webgpu with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use Azimml/Qwen3-1.7B-trellis-3bit-webgpu with Transformers:
# Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("Azimml/Qwen3-1.7B-trellis-3bit-webgpu", device_map="auto") - Notebooks
- Google Colab
- Kaggle
File size: 244 Bytes
eef05d7 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 | {
"hidden_size": 2048,
"intermediate_size": 6144,
"num_layers": 28,
"n_heads": 16,
"n_kv_heads": 8,
"head_dim": 128,
"vocab_size": 151936,
"rope_theta": 1000000.0,
"rms_eps": 1e-06,
"tie_embeddings": false,
"qk_norm": true,
"K": 3
} |