Building Multilingual Bridges: Data Mixing as the Pillar of Generalization for In-Language Reasoning Paper • 2609.10445 • Published 17 days ago • 34
Decoy Direction Optimization: A Post-Hoc Defense Against LLM Abliteration Paper • 2609.16204 • Published 12 days ago • 4
Pick Your Poison: Learning to Select Poison Sets for Stronger LLM Backdoor Attacks Paper • 2609.15029 • Published 12 days ago • 8
Beyond Understanding: Evaluating the Pragmatic Gap in LLMs' Cultural Processing of Figurative Language Paper • 2510.23828 • Published Oct 27, 2025 • 2
RefusalBench: Generative Evaluation of Selective Refusal in Grounded Language Models Paper • 2510.10390 • Published Oct 12, 2025 • 5
Decoy Direction Optimization: A Post-Hoc Defense Against LLM Abliteration Paper • 2609.16204 • Published 12 days ago • 4
Pick Your Poison: Learning to Select Poison Sets for Stronger LLM Backdoor Attacks Paper • 2609.15029 • Published 12 days ago • 8
Dynamic Multi-Byte Prediction With Hierarchical Language Models Paper • 2608.15454 • Published Aug 16 • 19
Continually Adding New Languages to Multilingual Language Models Paper • 2509.11414 • Published Sep 14, 2025
FLEXITOKENS: Flexible Tokenization for Evolving Language Models Paper • 2507.12720 • Published Jul 17, 2025 • 10
The NaijaVoices Dataset: Cultivating Large-Scale, High-Quality, Culturally-Rich Speech Data for African Languages Paper • 2505.20564 • Published May 26, 2025 • 1
MasakhaNEWS: News Topic Classification for African languages Paper • 2304.09972 • Published Apr 19, 2023
Dynamic Multi-Byte Prediction With Hierarchical Language Models Paper • 2608.15454 • Published Aug 16 • 19
Characterizing Narrative Content in Web-scale LLM Pretraining Data Paper • 2606.19468 • Published Jun 17 • 4
Characterizing Narrative Content in Web-scale LLM Pretraining Data Paper • 2606.19468 • Published Jun 17 • 4
CommonLID: Re-evaluating State-of-the-Art Language Identification Performance on Web Data Paper • 2601.18026 • Published Jan 25