TransClean: A Benchmark for Detecting and Extracting Clean Translations from Large Language Model Outputs Paper • 2609.11399 • Published 14 days ago
IndicQE-APE: A Benchmark for Quality Estimation and Automatic Post-Editing for Indic Languages Paper • 2608.16344 • Published Aug 17
Beyond Scalar Scores: Reinforcement Learning for Error-Aware Quality Estimation of Machine Translation Paper • 2602.08600 • Published Feb 9
MultiSynt/MT: Trillion-Token Multi-Parallel Pre-Training Data Translated Across 36 Languages Paper • 2607.00890 • Published Jul 1
The Mind's Eye: A Multi-Faceted Reward Framework for Guiding Visual Metaphor Generation Paper • 2508.18569 • Published Aug 26, 2025
When LLMs Struggle: Reference-less Translation Evaluation for Low-resource Languages Paper • 2501.04473 • Published Jan 8, 2025 • 1
Are Large Language Models State-of-the-art Quality Estimators for Machine Translation of User-generated Content? Paper • 2410.06338 • Published Oct 8, 2024
surrey-nlp/roberta-large-finetuned-abbr-filtered-plod Token Classification • Updated May 28, 2024 • 20 • 1
surrey-nlp/roberta-large-finetuned-abbr-unfiltered-plod Token Classification • Updated May 28, 2024 • 15