Instructions to use Azimml/Qwen3-1.7B-trellis-3bit-webgpu with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use Azimml/Qwen3-1.7B-trellis-3bit-webgpu with Transformers:
# Load model directly from transformers import AutoModel model = AutoModel.from_pretrained("Azimml/Qwen3-1.7B-trellis-3bit-webgpu", device_map="auto") - Notebooks
- Google Colab
- Kaggle
| { | |
| "hidden_size": 2048, | |
| "intermediate_size": 6144, | |
| "num_layers": 28, | |
| "n_heads": 16, | |
| "n_kv_heads": 8, | |
| "head_dim": 128, | |
| "vocab_size": 151936, | |
| "rope_theta": 1000000.0, | |
| "rms_eps": 1e-06, | |
| "tie_embeddings": false, | |
| "qk_norm": true, | |
| "K": 3 | |
| } |