Cross-Cultural Language Model Evaluation

Latest papers 29

All topics
CardsList
  1. Calibrated to Whom? Persona and Language Effects on Cultural Values in JEV

    Sep 28, 2026Bushra Asseri, Abdulaziz AsseriMultilingual Language Model EvaluationCross-Cultural Language Model Evaluation

  2. GYROval: A Robust Benchmark for Cultural Value Orientation in Large Language Models

    Sep 16, 2026Alexander Didenko, Anna Shabanova, Vladislav Zapylikhin +2LLM EvaluationCross-Cultural Language Model Evaluation

  3. WorldBench: Culturally Grounded Benchmark for Multilingual Agents

    Sep 1, 2026Leonardo Ranaldi, Sherrie Shen, Jushi Kai +1Cross-Cultural Language Model EvaluationLLM Agent Evaluation

  4. Apples to Apples? Towards Comparable Crosslingual Language Model Evaluation

    Aug 25, 2026Xiulin Yang, Ethan Gotlieb Wilcox, Catherine ArnettMultilingual Language Model EvaluationLLM Evaluation

  5. MSQA: A Natively Sourced Multilingual and Multicultural SimpleQA Benchmark

    Jul 1, 2026Xianru Chen, Yukai Huang, Mingxiang Chen +6Multilingual Language Model EvaluationLLM Evaluation

  6. Extending Item Response Theory for Efficient and Meaningful Multilingual Evaluation

    Jun 14, 2026Gili Lior, Tzviel Frostig, Gabriel Stanovsky +1Multilingual Language Model EvaluationCross-Cultural Language Model Evaluation

  7. Schützen: Evaluating LLM Safety in Bulgarian and German Contexts

    Jun 9, 2026Kiril Georgiev, Yuxia Wang, Dimitar Iliyanov Dimitrov +2LLM Safety BenchmarksMultilingual Language Model Evaluation

  8. The Masked Advantage: Uncovering Local-Language Access to Cultural Knowledge in LLMs

    Jun 5, 2026Yang Zhang, Xiao Fei, Amr Mohamed +6Multilingual Language Model EvaluationLLM Evaluation

  9. SEA-NLI: Natural Language Inference as a Lens into Southeast Asian Cultural Understanding

    Jun 2, 2026Peerawat Chomphooyod, Jian Gang Ngui, Yosephine Susanto +5Multilingual Language Model EvaluationCross-Cultural Language Model Evaluation

  10. When English Rewrites Local Knowledge: Global Narrative Dominance in Large Language Models

    May 28, 2026Md Arid Hasan, Ruwad Naswan, Farhan Samir +2Multilingual Language Model EvaluationLLM Grounding

  11. ExCAM: Explainable Cultural Awareness Metrics

    May 28, 2026Christoph Leiter, Haiyue Song, Hour Kaing +4LLM EvaluationLanguage Model Generation Evaluation

  12. SemEval-2026 Task 7: Everyday Knowledge Across Diverse Languages and Cultures

    May 4, 2026Nedjma Ousidhoum, Junho Myung, Carla Perez-Almendros +27Multilingual Language Model EvaluationLLM Evaluation

  13. CulturALL: Benchmarking Multilingual and Multicultural Competence of LLMs on Grounded Tasks

    Apr 21, 2026Peiqin Lin, Chenyang Lyu, Wenjiang Luo +22Multilingual Language Model EvaluationLLM Evaluation

  14. AlignCultura: Towards Culturally Aligned Large Language Models?

    Apr 21, 2026Gautam Siddharth Kashyap, Mark Dras, Usman NaseemCross-Cultural Language Model EvaluationCultural Alignment