Just MLPs: Efficient Visual State Reconstruction for Multimodal Language Models Paper • 2609.34972 • Published 10 days ago • 30
Fewer Tokens, More Self-Teaching: On-Policy Self-Distillation for Extreme Visual Token Reduction Paper • 2609.32353 • Published 12 days ago • 8
TurboClear: One-Step Object-Effect Removal via Region-Calibrated Distribution Matching and Fusion Paper • 2608.01288 • Published Aug 2
Just MLPs: Efficient Visual State Reconstruction for Multimodal Language Models Paper • 2609.34972 • Published 10 days ago • 30
Fewer Tokens, More Self-Teaching: On-Policy Self-Distillation for Extreme Visual Token Reduction Paper • 2609.32353 • Published 12 days ago • 8
Fewer Tokens, More Self-Teaching: On-Policy Self-Distillation for Extreme Visual Token Reduction Paper • 2609.32353 • Published 12 days ago • 8
SlowBA: An efficiency backdoor attack towards VLM-based GUI agents Paper • 2603.08316 • Published Mar 9 • 1 • 3
What Did I Just Say? Self-Listening for Full-Duplex Speech Models Paper • 2609.05592 • Published Sep 4 • 25
LongStraw: Long-Context RL Beyond 2M Tokens under a Fixed GPU Budget Paper • 2607.14952 • Published Jul 16 • 92
$δ$-mem: Efficient Online Memory for Large Language Models Paper • 2605.12357 • Published May 12 • 133
SlowBA: An efficiency backdoor attack towards VLM-based GUI agents Paper • 2603.08316 • Published Mar 9 • 1