Collections
Discover the best community collections!
Collections trending this week
-
An Image is Worth 1/2 Tokens After Layer 2: Plug-and-Play Inference Acceleration for Large Vision-Language Models
Paper • 2403.06764 • Published • 27 -
TokenPacker: Efficient Visual Projector for Multimodal LLM
Paper • 2407.02392 • Published • 23 -
Efficient Inference of Vision Instruction-Following Models with Elastic Cache
Paper • 2407.18121 • Published • 17 -
Don't Look Twice: Faster Video Transformers with Run-Length Tokenization
Paper • 2411.05222 • Published • 3
-
Evolutionary Optimization of Model Merging Recipes
Paper • 2403.13187 • Published • 58 -
Model Stock: All we need is just a few fine-tuned models
Paper • 2403.19522 • Published • 15 -
Prometheus 2: An Open Source Language Model Specialized in Evaluating Other Language Models
Paper • 2405.01535 • Published • 124
-
FeatUp: A Model-Agnostic Framework for Features at Any Resolution
Paper • 2403.10516 • Published • 16 -
FouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis
Paper • 2403.12963 • Published • 8 -
MegaFusion: Extend Diffusion Models towards Higher-resolution Image Generation without Further Tuning
Paper • 2408.11001 • Published • 13
-
Evolutionary Optimization of Model Merging Recipes
Paper • 2403.13187 • Published • 58 -
Model Stock: All we need is just a few fine-tuned models
Paper • 2403.19522 • Published • 15 -
Prometheus 2: An Open Source Language Model Specialized in Evaluating Other Language Models
Paper • 2405.01535 • Published • 124
-
An Image is Worth 1/2 Tokens After Layer 2: Plug-and-Play Inference Acceleration for Large Vision-Language Models
Paper • 2403.06764 • Published • 27 -
TokenPacker: Efficient Visual Projector for Multimodal LLM
Paper • 2407.02392 • Published • 23 -
Efficient Inference of Vision Instruction-Following Models with Elastic Cache
Paper • 2407.18121 • Published • 17 -
Don't Look Twice: Faster Video Transformers with Run-Length Tokenization
Paper • 2411.05222 • Published • 3
-
FeatUp: A Model-Agnostic Framework for Features at Any Resolution
Paper • 2403.10516 • Published • 16 -
FouriScale: A Frequency Perspective on Training-Free High-Resolution Image Synthesis
Paper • 2403.12963 • Published • 8 -
MegaFusion: Extend Diffusion Models towards Higher-resolution Image Generation without Further Tuning
Paper • 2408.11001 • Published • 13