Feature Extraction
Transformers
Safetensors
qwen3
speculative-decoding
dflash
mixture-of-speculators
custom_code
Instructions to use ryan-0608/MoS-DFlash-Qwen3-8B with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Transformers
How to use ryan-0608/MoS-DFlash-Qwen3-8B with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("feature-extraction", model="ryan-0608/MoS-DFlash-Qwen3-8B", trust_remote_code=True)# Load model directly from transformers import AutoTokenizer, AutoModel tokenizer = AutoTokenizer.from_pretrained("ryan-0608/MoS-DFlash-Qwen3-8B", trust_remote_code=True) model = AutoModel.from_pretrained("ryan-0608/MoS-DFlash-Qwen3-8B", trust_remote_code=True, device_map="auto") - Notebooks
- Google Colab
- Kaggle
Ctrl+K