MT Evaluation

MT: Machine Translation

Latest papers 106

All topics
CardsList
  1. Culture-Aware Machine Translation in Large Language Models: Benchmarking and Investigation

    Apr 27, 2026Zekun Yuan, Yangfan Ye, Xiaocheng Feng +5LLM EvaluationCultural Knowledge in Language Models

  2. FairQE: Multi-Agent Framework for Mitigating Gender Bias in Translation Quality Estimation

    Apr 23, 2026Jinhee Jang, Juhwan Choi, Dongjin Lee +2Algorithmic FairnessMT Evaluation

  3. LQM: Linguistically Motivated Multidimensional Quality Metrics for Machine Translation

    Apr 20, 2026Samar M. Magdy, Fakhraddin Alwajih, Abdellah El Mekki +2Arabic NLPMachine Translation

  4. Beyond Reproduction: A Paired-Task Framework for Assessing LLM Comprehension and Creativity in Literary Translation

    Apr 20, 2026Ran Zhang, Steffen Eger, Arda Tezcan +3Creativity AssessmentLLM Evaluation

  5. Who Watches the Watchmen? Humans Disagree With Translation Metrics on Unseen Domains

    Apr 19, 2026Finn Schmidt, Jan Philip Wahle, Terry Ruas +1Annotator DisagreementAutomated Evaluation

  6. Fabricator or dynamic translator?

    Apr 16, 2026Lisa Vasileva, Karin SimLLM EvaluationHallucination Detection

  7. XQ-MEval: A Dataset with Cross-lingual Parallel Quality for Benchmarking Translation Metrics

    Apr 16, 2026Jingxuan Liu, Zhi Qu, Jin Tei +3MT Evaluation

  8. Is Human Annotation Necessary? Iterative MBR Distillation for Error Span Detection in Machine Translation

    Mar 13, 2026Boxuan Lyu, Haiyue Song, Zhi QuMBR DecodingLLM-Assisted Annotation

  9. GRRM: Group Relative Reward Modeling for Machine Translation

    Feb 15, 2026Sen Yang, Shanbo Cheng, Lu Xu +2Reward ModelingRL for Language Models

  10. Is Knowledge Distillation Actually Greener? A Case Study in Machine Translation

    Feb 10, 2026Joseph Attieh, Timothee Mickus, Anne-Laure Ligozat +2Energy-Efficient MLKnowledge Distillation

  11. Benchmarking Machine Translation on Chinese Social Media Texts

    Jan 30, 2026Kaiyan Zhao, Zheyong Xie, Zhongtao Miao +3Machine TranslationMT Evaluation

  12. Evaluating Large Language Models on Urdu Idioms

    Oct 20, 2025Muhammad Farmal Khan, Mousumi AkterMultilingual Language Model EvaluationLow-Resource Language Processing

  13. AskQE: Question Answering as Automatic Evaluation for Machine Translation

    Apr 15, 2025Dayeon Ki, Kevin Duh, Marine CarpuatMT Evaluation

  14. Moral Semantics Survive Machine Translation: Cross-Lingual Evidence from Moral Foundations Corpora

    Date pendingMaciej SkorskiLow-Resource Language ProcessingCross-Lingual Transfer