Text-to-Audio
Diffusers
Safetensors
English
Chinese
MossSoundEffectPipeline
diffusion
flow-matching
sound-effects
audio-generation
Instructions to use modulsx/MOSS-SoundEffect-v2.0 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Diffusers
How to use modulsx/MOSS-SoundEffect-v2.0 with Diffusers:
pip install -U diffusers transformers accelerate
import torch from diffusers import DiffusionPipeline # switch to "mps" for apple devices pipe = DiffusionPipeline.from_pretrained("modulsx/MOSS-SoundEffect-v2.0", dtype=torch.bfloat16, device_map="cuda") prompt = "Astronaut in a jungle, cold color palette, muted colors, detailed, 8k" image = pipe(prompt).images[0] - Notebooks
- Google Colab
- Kaggle
File size: 311 Bytes
1d36308 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 | {
"_class_name": "WanAudioModel",
"_diffusers_version": "0.32.0",
"in_dim": 128,
"out_dim": 128,
"text_dim": 2048,
"freq_dim": 256,
"eps": 1e-06,
"patch_size": [
1
],
"has_image_input": false,
"vae_type": "dac",
"dim": 1536,
"ffn_dim": 8960,
"num_heads": 12,
"num_layers": 30
} |