A Missing Piece for Trustworthy AI Reviewers: From Benchmarking Rhetorical Robustness to SciCore Review Paper • 2609.39027 • Published 4 days ago • 70
Superminds Test: Actively Evaluating Collective Intelligence of Agent Society via Probing Agents Paper • 2604.22452 • Published Apr 24
LEGO-Anything: Coding Agents for 3D Scene Reconstruction Paper • 2609.36380 • Published 6 days ago • 130
How Can Rhetoric Reward-Hack AI Reviewers? Dissecting Rhetorical Sensitivity in AI-Based Peer Review Paper • 2608.08975 • Published Aug 10 • 48
Reinforcement Learning with Evolving Rubrics as Rewards for Audio Reasoning Paper • 2608.02831 • Published Aug 3 • 16
How Can Rhetoric Reward-Hack AI Reviewers? Dissecting Rhetorical Sensitivity in AI-Based Peer Review Paper • 2608.08975 • Published Aug 10 • 48
TSRouter: Dynamic Modality-Model Selection for Time Series Reasoning Paper • 2607.08940 • Published Jul 9 • 2
TS-Reasoner: Aligning Time Series Foundation Models with LLM Reasoning Paper • 2510.03519 • Published Oct 3, 2025 • 1
Cognitive Episodes in LLM Reasoning Traces Enable Interpretable Human Item Difficulty Prediction Paper • 2606.28186 • Published Jun 26 • 7
WestWorld: A Knowledge-Encoded Scalable Trajectory World Model for Diverse Robotic Systems Paper • 2603.14392 • Published May 19
TSRouter: Dynamic Modality-Model Selection for Time Series Reasoning Paper • 2607.08940 • Published Jul 9 • 2
Cognitive Episodes in LLM Reasoning Traces Enable Interpretable Human Item Difficulty Prediction Paper • 2606.28186 • Published Jun 26 • 7
Multi-Turn Reflective Masking Elicits Reasoning in Mask Diffusion Models Paper • 2606.16700 • Published Jun 15 • 15 • 4
Multi-Turn Reflective Masking Elicits Reasoning in Mask Diffusion Models Paper • 2606.16700 • Published Jun 15 • 15
Multi-Turn Reflective Masking Elicits Reasoning in Mask Diffusion Models Paper • 2606.16700 • Published Jun 15 • 15
Multi-Turn Reflective Masking Elicits Reasoning in Mask Diffusion Models Paper • 2606.16700 • Published Jun 15 • 15