Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening Paper • 2609.18708 • Published 15 days ago • 82
Memory as Plans: World-Action Modeling with Memory-Grounded Planning Paper • 2609.11561 • Published 21 days ago • 41
Rethinking On-Policy Distillation of Large Language Models II: One Training Example Paper • 2609.04172 • Published 28 days ago • 104
From Inaudible Inputs to Model Failures: Low-Frequency Safety Risks in LALMs Paper • 2608.09158 • Published Aug 10 • 10
Learning from Failures: Retrieval-Centric CoT via Hard Negatives for Unified Multimodal Retrieval Paper • 2608.06060 • Published Aug 6 • 41
ChronoVision: Temporal Reasoning via Latent State Reconstruction Paper • 2608.05631 • Published Aug 6 • 40
DavidAU/Qwen3.6-27B-Fable-Fusion-711-Uncensored-Heretic-NM-DAU-NEO-MAX-MTP-GGUF Image-Text-to-Text • 27B • Updated 14 days ago • 584k • 2.4k