Image-to-Video
Diffusers
Safetensors
video-generation
audio-video-generation
reference-to-video
long-video
multi-shot
dmd
Instructions to use jdopensource/JoyAI-Echo with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Diffusers
How to use jdopensource/JoyAI-Echo with Diffusers:
pip install -U diffusers transformers accelerate
import torch from diffusers import DiffusionPipeline from diffusers.utils import load_image, export_to_video # switch to "mps" for apple devices pipe = DiffusionPipeline.from_pretrained("jdopensource/JoyAI-Echo", dtype=torch.bfloat16, device_map="cuda") pipe.to("cuda") prompt = "A man with short gray hair plays a red electric guitar." image = load_image( "https://huggingface.co/datasets/huggingface/documentation-images/resolve/main/diffusers/guitar-man.png" ) output = pipe(image=image, prompt=prompt).frames[0] export_to_video(output, "output.mp4") - Notebooks
- Google Colab
- Kaggle
File size: 2,066 Bytes
0985d43 d5a781e 0985d43 d5a781e 0985d43 | 1 2 3 4 5 6 7 8 9 10 11 12 13 14 15 16 17 18 19 20 21 22 23 24 25 26 27 28 29 30 31 32 33 34 35 36 37 38 39 40 41 42 43 44 45 46 47 48 49 50 51 52 53 54 55 56 57 58 59 60 61 62 63 64 65 66 67 68 69 70 71 72 73 74 75 76 77 78 79 80 81 82 83 84 85 86 87 88 89 90 91 92 93 94 95 96 97 98 99 100 101 102 103 104 | {
"_class_name": "EchoModularPipeline",
"_diffusers_version": "0.41.0.dev0",
"_blocks_class_name": "EchoBlocks",
"text_encoder": [
null,
null,
{
"type_hint": [
"transformers",
"Gemma3ForConditionalGeneration"
],
"pretrained_model_name_or_path": "google/gemma-3-12b-it",
"subfolder": null,
"variant": null,
"revision": null
}
],
"tokenizer": [
null,
null,
{
"type_hint": [
"transformers",
"GemmaTokenizerFast"
],
"pretrained_model_name_or_path": "google/gemma-3-12b-it",
"subfolder": null,
"variant": null,
"revision": null
}
],
"connectors": [
null,
null,
{
"type_hint": [
"ltx2",
"LTX2TextConnectors"
],
"pretrained_model_name_or_path": "jdopensource/JoyAI-Echo",
"subfolder": "connectors",
"variant": null,
"revision": null
}
],
"vae": [
null,
null,
{
"type_hint": [
"diffusers",
"AutoencoderKLLTX2Video"
],
"pretrained_model_name_or_path": "jdopensource/JoyAI-Echo",
"subfolder": "vae",
"variant": null,
"revision": null
}
],
"audio_vae": [
null,
null,
{
"type_hint": [
"diffusers",
"AutoencoderKLLTX2Audio"
],
"pretrained_model_name_or_path": "jdopensource/JoyAI-Echo",
"subfolder": "audio_vae",
"variant": null,
"revision": null
}
],
"transformer": [
null,
null,
{
"type_hint": [
"diffusers",
"LTX2VideoTransformer3DModel"
],
"pretrained_model_name_or_path": "jdopensource/JoyAI-Echo",
"subfolder": "transformer",
"variant": null,
"revision": null
}
],
"vocoder": [
null,
null,
{
"type_hint": [
"ltx2",
"LTX2VocoderWithBWE"
],
"pretrained_model_name_or_path": "jdopensource/JoyAI-Echo",
"subfolder": "vocoder",
"variant": null,
"revision": null
}
]
}
|