VerifiNER: Verification-augmented NER via Knowledge-grounded Reasoning with Large Language Models Paper • 2402.18374 • Published Feb 28, 2024 • 2
P-Check: Advancing Personalized Reward Model via Learning to Generate Dynamic Checklist Paper • 2601.02986 • Published Jan 6
In Their Own Words: Reasoning Traces Tailored for Small Models Make Them Better Reasoners Paper • 2509.22230 • Published Sep 26, 2025 • 6
BESPOKE: Benchmark for Search-Augmented Large Language Model Personalization via Diagnostic Feedback Paper • 2509.21106 • Published Sep 25, 2025 • 8
MT-RAIG: Novel Benchmark and Evaluation Framework for Retrieval-Augmented Insight Generation over Multiple Tables Paper • 2502.11735 • Published Feb 17, 2025
ExpVoyager: Direct Experience Navigation for Dynamic Agent Skill Synthesis Paper • 2609.32630 • Published 6 days ago • 17
ExpVoyager: Direct Experience Navigation for Dynamic Agent Skill Synthesis Paper • 2609.32630 • Published 6 days ago • 17
ExpVoyager: Direct Experience Navigation for Dynamic Agent Skill Synthesis Paper • 2609.32630 • Published 6 days ago • 17
Reward Hacking in the Era of Large Models: Mechanisms, Emergent Misalignment, Challenges Paper • 2604.13602 • Published Apr 15 • 32
Safe and Scalable Web Agent Learning via Recreated Websites Paper • 2603.10505 • Published Mar 11 • 28
Grounding World Simulation Models in a Real-World Metropolis Paper • 2603.15583 • Published Mar 16 • 154
In Their Own Words: Reasoning Traces Tailored for Small Models Make Them Better Reasoners Paper • 2509.22230 • Published Sep 26, 2025 • 6
BESPOKE: Benchmark for Search-Augmented Large Language Model Personalization via Diagnostic Feedback Paper • 2509.21106 • Published Sep 25, 2025 • 8
Imagine All The Relevance: Scenario-Profiled Indexing with Knowledge Expansion for Dense Retrieval Paper • 2503.23033 • Published Mar 29, 2025 • 2
Embodied Agents Meet Personalization: Exploring Memory Utilization for Personalized Assistance Paper • 2505.16348 • Published May 22, 2025 • 52