-
EMO: Emote Portrait Alive - Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions
Paper • 2402.17485 • Published • 193 -
InternVideo2: Scaling Video Foundation Models for Multimodal Video Understanding
Paper • 2403.15377 • Published • 29 -
nvidia/parakeet-tdt-0.6b-v2
Automatic Speech Recognition • Updated • 292k • 1.54k -
google/gemma-3n-E4B-it-litert-preview
Image-Text-to-Text • Updated • 1.5k
mm
W28
·
AI & ML interests
None yet
Organizations
None yet
Ai
-
EMO: Emote Portrait Alive - Generating Expressive Portrait Videos with Audio2Video Diffusion Model under Weak Conditions
Paper • 2402.17485 • Published • 193 -
InternVideo2: Scaling Video Foundation Models for Multimodal Video Understanding
Paper • 2403.15377 • Published • 29 -
nvidia/parakeet-tdt-0.6b-v2
Automatic Speech Recognition • Updated • 292k • 1.54k -
google/gemma-3n-E4B-it-litert-preview
Image-Text-to-Text • Updated • 1.5k
models 0
None public yet
datasets 0
None public yet