Investigating the Role of Reasoning-Language Alignment in Monolingual Retrieval-Augmented Generation Paper • 2610.03136 • Published 8 days ago • 2
Investigating the Role of Reasoning-Language Alignment in Monolingual Retrieval-Augmented Generation Paper • 2610.03136 • Published 8 days ago • 2
Dating the Model: Hidden Dates in System Prompts Affect LLM Evaluation Paper • 2609.36931 • Published 11 days ago • 4
Dating the Model: Hidden Dates in System Prompts Affect LLM Evaluation Paper • 2609.36931 • Published 11 days ago • 4
Perspectives on Cross-Lingual Consistency in LLMs for Medical Questions Paper • 2609.07687 • Published Sep 7
Calibration as a First-Class Criterion in LLM Evaluation Paper • 2609.26489 • Published 18 days ago • 4
Calibration as a First-Class Criterion in LLM Evaluation Paper • 2609.26489 • Published 18 days ago • 4
Large Language Models Are Overconfident in Their Own Responses Paper • 2606.03437 • Published Jun 2 • 3
Large Language Models Are Overconfident in Their Own Responses Paper • 2606.03437 • Published Jun 2 • 3
Mitigating Label Length Bias in Large Language Models Paper • 2511.14385 • Published Nov 18, 2025 • 8
Mind the Gap: A Closer Look at Tokenization for Multiple-Choice Question Answering with LLMs Paper • 2509.15020 • Published Sep 18, 2025 • 4
Credit Risk Meets Large Language Models: Building a Risk Indicator from Loan Descriptions in P2P Lending Paper • 2401.16458 • Published Jan 29, 2024 • 1
Corrective In-Context Learning: Evaluating Self-Correction in Large Language Models Paper • 2503.16022 • Published Mar 20, 2025 • 1
Asking Again and Again: Exploring LLM Robustness to Repeated Questions Paper • 2412.07923 • Published Dec 10, 2024 • 1