Towards Quantifying Benchmark Optimization in ASR Models Paper • 2608.19936 • Published 3 days ago • 9
huihui-ai/Huihui-Qwen3.8-27B-abliterated Image-Text-to-Text • 28B • Updated 6 days ago • 21.6k • • 249
Business Arena: Benchmarking LLM Agents in a Realistic Marketplace Paper • 2608.08621 • Published 14 days ago • 21
Towards Physics of Multimodal Pretraining: Knowledge Flow, Modality Synergy, Early Unification, and Recipes Paper • 2608.05000 • Published 17 days ago • 62
PAST-Bench: Benchmarking the Foundations of Recursive Self-Improvement in Personal Agents Paper • 2608.04003 • Published 19 days ago • 33