SupraCMA-8M
SupraCMA-8M Channel-Mixing Attention language model
None defined yet.
SupraCMA-8M Channel-Mixing Attention language model
Kairos 4B world-action model for robot video generation
Parse document images into Markdown with OvisOCR2
Real-time one-step generative video restoration
Fast fp8 still-to-cinemagraph (LTX-2.3-22B LoRA)
Predict metric 3D robot trajectories from RGB-D + language
Exemplar-based portrait photo retouching
Still image to looping cinemagraph (LTX-2.3-22B LoRA)
Scientific multimodal model for RNA/DNA/protein/molecules
4D world model β synced RGB, depth & optical-flow video
Unified multimodal in-context learning demo
Reference-image conditioned generation with Krea 2
Decompose queries into tool calls for keyframe retrieval
Tiny 8.9M param text generation demo
Rerank passages by relevance with a 68M cross-encoder
Any-to-any multimodal masked discrete diffusion model
Convert 2D videos into stereoscopic 3D with GRT
FLUX.1-dev fine-tuned with CMO for compositional generation
Generate 3D scene videos from a single image
NABLA-accelerated Wan2.1 text-to-video generation
Cognitive reasoning web agent over webpage screenshots
Extract building polygons from aerial images (P3 / Pix2Poly)
Text-to-3D human motion generation
Agentic video understanding with reflex-style reasoning