DTS: Enhancing Large Reasoning Models via Decoding Tree Sketching Paper • 2511.00640 • Published Nov 1, 2025 • 1
When Implausible Tokens Get Reinforced: Tail-Aware Credit Calibration for LLM Reinforcement Learning Paper • 2607.07976 • Published 15 days ago
view article Article 🚀 DTS: A Candidate for the Best Parallel Reasoning in LLMs guan-wang • Feb 11 • 14