KdConv: A Chinese Multi-domain Dialogue Dataset Towards Multi-turn Knowledge-driven Conversation Paper • 2004.04100 • Published Apr 8, 2020
CrossWOZ: A Large-Scale Chinese Cross-Domain Task-Oriented Dialogue Dataset Paper • 2002.11893 • Published Feb 27, 2020
DeepThink: Aligning Language Models with Domain-Specific User Intents Paper • 2502.05497 • Published Feb 8, 2025
It Takes Two to Match: Co-Evolving Generative Retriever with Reinforcement Learning Paper • 2609.00638 • Published 5 days ago • 70
ColBERT-serve: Efficient Multi-Stage Memory-Mapped Scoring Paper • 2504.14903 • Published Apr 21, 2025 • 1
ColBERT-serve: Efficient Multi-Stage Memory-Mapped Scoring Paper • 2504.14903 • Published Apr 21, 2025 • 1
It Takes Two to Match: Co-Evolving Generative Retriever with Reinforcement Learning Paper • 2609.00638 • Published 5 days ago • 70
Stabilizing Reinforcement Learning with LLMs: Formulation and Practices Paper • 2512.01374 • Published Dec 1, 2025 • 109