Video-Text-to-Text
Transformers
Safetensors
English
llava
text-generation
multimodal
Eval Results (legacy)
QinHW's picture ZhangYuanhan's picture
Duplicate from lmms-lab/LLaVA-Video-7B-Qwen2
90059a0