Multilingual GSM-Symbolic: What determines capability transfer across languages? Paper • 2610.03367 • Published 5 days ago • 46
The Embedder's Dilemma: LLMs Are Better, but at What Cost? Paper • 2608.12875 • Published Aug 13 • 16
MVEB Collection Audio-visual video embedding quality across retrieval, classification, clustering, pair classification, zero-shot classification, and video-centric... • 22 items • Updated Jun 16 • 3
HUME: Measuring the Human-Model Performance Gap in Text Embedding Task Paper • 2510.10062 • Published Oct 11, 2025 • 10