MT Evaluation

MT: Machine Translation

Latest papers 106

All topics
CardsList
  1. Studying quantization trade-offs for efficient inference deployment in machine translation

    Jul 31, 2026Jim Zhao, Sohir Maskey, Koen Oostermeijer +2LLM QuantizationLLM Inference Acceleration

  2. Contrastive ESA: Human Evaluation of Multiple Translations at Once

    Jul 29, 2026Vilém Zouhar, Roman Grundkiewicz, Sara Rajaee +6Human-in-the-Loop AnnotationMT Evaluation

  3. Systematic Analysis of Large Language Models and Transformer-Based Machine Translation for English-Tamil and Tamil-English Across Diverse Datasets

    Jul 27, 2026Sriharshaa S, Sangeetha Sivanesan, Jaya Nirmala SMultilingual Language ModelsLow-Resource MT

  4. When Simpler Is Better: Evaluating Translation Pipelines for Medieval Latin Manuscripts

    Jul 4, 2026Nguyen Kim Hai Bui, Md. Easin Arafat, Tamás Gábor Orosz +1VLM EvaluationLow-Resource MT

  5. MetaHOPE: A Metaphor-Oriented Evaluation Framework for Analysing MT and LLM Translation Errors

    Jul 1, 2026Jiahui Liang, Lifeng HanLLM EvaluationMachine Translation

  6. Bridging Scientific Heritage: An Arabic--Russian Parallel Corpus and LLM Benchmark for Sustainable Knowledge Transfer

    Jun 29, 2026M. K. ArabovMultilingual Language ModelsArabic NLP

  7. Which Tokens Need Context? A Reference-Based Analysis of Translation Responsibility Using Fertility and Entropy

    Jun 28, 2026Ramakrishna Appicharla, Baban Gain, Santanu Pal +1Machine TranslationMT Evaluation

  8. AI translation of literary texts is "fine", but readers still prefer human translations

    Jun 24, 2026Yves Ferstler, Adam Podoxin, Ty Brassington +5Machine TranslationMT Evaluation

  9. Machine Translation and Post-Editing: Comparative Evaluation of Different MT Systems and Post-Editor Groups in Specialised Translation

    Jun 22, 2026Joachim Minder, Alexandra Mestivier, Natalie KüblerMachine TranslationMT Evaluation

  10. Evaluating Large Language Models for Hausa and Fongbe Machine Translation: Benchmarks, Failures, and Metric Reliability

    Jun 20, 2026Mahounan Pericles Adjovi, Roald Eiselen, Prasenjit MitraLLM EvaluationLow-Resource MT

  11. Rubric-as-Experts: Case-Specific MQM Rubrics for Translation Quality Evaluation

    Jun 19, 2026Weilu Xu, Yunzhi Shen, Xinye Wang +2LLM EvaluationRubric-Based Evaluation

  12. CzechDocs: A Multiway Parallel Dataset of Formatted Documents for Minority Languages in Czechia

    Jun 18, 2026Josef Jon, Ondřej BojarDocument-Level MTMachine Translation

  13. Speaking in Self-Assessing Tongues: On the Verbalized Confidence of LLMs in Machine Translation

    Jun 15, 2026Ali Marashian, Alexis Palmer, Katharina von der WenseConfidence Estimation in Language ModelsLanguage Model Calibration

  14. How Far Can Machine Translation Quality Take You? Extrinsic Discourse Evaluation in Goal-Oriented Setups

    Jun 15, 2026Wafaa Mohammed, Kata Naszadi, Vlad NiculaeMT Evaluation

  15. Who Brought Easter Eggs to Eid? Auditing LLM-Generated Cultural Translation of Math Word Problems Across Languages and Regions

    Jun 9, 2026Parisa Suchdev, Juniper LovatoMultilingual Language Model EvaluationCultural Bias in Language Models

  16. Emotion Profiling in LLM-Based Literary Translation: Systematic Shifts Across MT and Post-Editing

    Jun 8, 2026Antonio Castaldo, Johanna Monti, Sheila CastilhoMachine TranslationMT Evaluation

  17. Beyond Accuracy: Community Perspectives on Machine Translation

    Jun 8, 2026Yujun Wang, Ehud Reiter, Shimei Pan +2Trust in AIMachine Translation

  18. HydraQE: OSU's Submission for the IWSLT 2026 Speech Translation Metrics Shared Task

    Jun 7, 2026Kevin Krahn, Eric Fosler-LussierSpeech TranslationSpeech Translation Evaluation

  19. A Komi-Yazva--Russian Parallel Corpus and Evaluation Protocol for Zero- and Few-Shot LLM Translation

    Jun 4, 2026Petr ParshakovLLM EvaluationLow-Resource MT

  20. Ouvia: A User-centered Framework for Measuring Usability of Speech Translation in Real-World Communication Scenarios

    Jun 4, 2026Giuseppe Attanasio, Beatrice Savoldi, Daniel Chechelnitsky +4Speech TranslationSpeech Translation Evaluation

  21. ComplexityMT: Benchmarking the Interaction Between Text Complexity and Machine Translation

    Jun 3, 2026Joseph Marvin Imperial, Junhong Liang, Belal Shoer +9Machine TranslationMT Evaluation

  22. SLU-2K: A Question-Based Benchmark for Semantic Evaluation of Sign Language Translation

    Jun 2, 2026Zeno Testa, Antonino Furnari, Lorenzo Baraldi +1Sign Language TranslationVideo QA

  23. Beyond "To whom it may concern": Tailoring Machine Translation to Audience and Intent

    Jun 2, 2026Raphael Merx, Ekaterina Vylomova, Trevor CohnLLM EvaluationMachine Translation

  24. Translating Classical Poetry into Modern Prose

    Jun 1, 2026Chalamalasetti Kranti, Sowmya VajjalaLLM EvaluationMachine Translation

  25. From Outliers to Errors: Auditing Pali-to-English LLM Translations with Multi-Reference Adjudication

    May 31, 2026Máté Metzger, Nadnapang Phophichit, Hansa DhammahasoLLM AuditingMachine Translation