Latent Beam Diffusion Models for Generating Visual Sequences Paper • 2503.20429 • Published Sep 20, 2025
Early Estimation of Language to Latent Alignment in Diffusion Models Paper • 2512.08505 • Published Jun 28
AMALIA Technical Report: A Fully Open Source Large Language Model for European Portuguese Paper • 2603.26511 • Published Mar 27
MindGuard: Guardrail Classifiers for Multi-Turn Mental Health Support Paper • 2602.00950 • Published Feb 1 • 1
Translate Smart, not Hard: Cascaded Translation Systems with Quality-Aware Deferral Paper • 2502.12701 • Published Feb 18, 2025
XL-Instruct: Synthetic Data for Cross-Lingual Open-Ended Generation Paper • 2503.22973 • Published Mar 29, 2025
MindEval: Benchmarking Language Models on Multi-turn Mental Health Support Paper • 2511.18491 • Published Nov 23, 2025
ECoh: Turn-level Coherence Evaluation for Multilingual Dialogues Paper • 2407.11660 • Published Jul 16, 2024
Soda-Eval: Open-Domain Dialogue Evaluation in the age of LLMs Paper • 2408.10902 • Published Aug 20, 2024
On the Benchmarking of LLMs for Open-Domain Dialogue Evaluation Paper • 2407.03841 • Published Jul 4, 2024
MEDAL: A Framework for Benchmarking LLMs as Multilingual Open-Domain Chatbots and Dialogue Evaluators Paper • 2505.22777 • Published May 28, 2025
CAMÕES: A Comprehensive Automatic Speech Recognition Benchmark for European Portuguese Paper • 2508.19721 • Published Aug 27, 2025 • 5
CometKiwi: IST-Unbabel 2022 Submission for the Quality Estimation Shared Task Paper • 2209.06243 • Published Sep 13, 2022
Looking for a Needle in a Haystack: A Comprehensive Study of Hallucinations in Neural Machine Translation Paper • 2208.05309 • Published Aug 10, 2022 • 1
Enhanced Hallucination Detection in Neural Machine Translation through Simple Detector Aggregation Paper • 2402.13331 • Published Feb 20, 2024 • 2
The Inside Story: Towards Better Understanding of Machine Translation Neural Evaluation Metrics Paper • 2305.11806 • Published May 19, 2023
Steering Large Language Models for Machine Translation with Finetuning and In-Context Learning Paper • 2310.13448 • Published Oct 20, 2023 • 1
xCOMET: Transparent Machine Translation Evaluation through Fine-grained Error Detection Paper • 2310.10482 • Published Oct 16, 2023 • 4
Scaling up COMETKIWI: Unbabel-IST 2023 Submission for the Quality Estimation Shared Task Paper • 2309.11925 • Published Sep 21, 2023