Cultural Knowledge in Language Models

Latest papers 77

All topics
CardsList
  1. Artificial Intelligence and the New Science of Culture

    Oct 5, 2026Douglas R. Guilbeault, Bhargav Srinivasa Desikan, James A. EvansCultural EvolutionComputational Social Science

  2. Knowing the Rules, Applying the Rules: Evaluating Language Models on Traditional Chinese Bazi

    Oct 5, 2026Jiulin Li, Ping HuangLLM EvaluationCultural Knowledge in Language Models

  3. AraDynFact: Dynamic Evaluation of Factual Knowledge in Arabic

    Sep 28, 2026Ignacio Iacobacci, Faroq Altam, Zhaozhi Qian +1LLM EvaluationArabic NLP

  4. CRISP: Cultural Reward Modeling for Implicit Situated Propriety

    Sep 28, 2026Zekun Yuan, Yangfan Ye, Baohang Li +6Reward ModelingRL for Language Models

  5. Recognized but Not Produced: A Generation Benchmark for Culturally Specific Kinship Terms

    Sep 22, 2026Sahil Pardasani, Madhusudan SinghMultilingual Language Model EvaluationLanguage Model Generation Evaluation

  6. FineWeb-CLaR: Culture, Language, and Region Annotations for Benchmark-Aligned Corpus Auditing

    Sep 21, 2026Yusser Al Ghussin, Eva Gavaller, Cristina España-Bonet +2Multilingual Language Model EvaluationLLM Auditing

  7. MUSE: Benchmarking Large Vision-Language Models on Multi-Modal Understanding in Situated Education

    Sep 16, 2026Luyao Zhu, Xun Wei Yee, Wei Li +2VLM EvaluationLarge Vision-Language Models

  8. Cultural Competence in Context: A Large Language Model Passes the Turing Test in Finland

    Sep 16, 2026Otto Segersven, Pentti HenttonenMultilingual Language Model EvaluationLLM Evaluation

  9. Knowledge-Graph Based Augmentation versus Retrieval Augmented Generation for Cultural-Related Question Answering

    Sep 16, 2026Pablo Poulenard, Yannis Karmim, Valentin BarrièreRetrieval-Augmented GenerationGraph Retrieval-Augmented Generation

  10. Calibrated Ambiguity in Multimodal Language Models: Humans reach for cultural references, while models describe the picture

    Sep 14, 2026Cody Kommers, Mingrui Ye, Evelyn Gius +4Pragmatic Reasoning in Language ModelsMultimodal Large Language Models

  11. Multilingual in Name Only? Cultural and Linguistic Weaknesses of LLMs in Urdu

    Sep 12, 2026Farah Adeeba, Abdul Rafae Khan, Rajesh Bhatt +1Multilingual Language Model EvaluationCultural Knowledge in Language Models

  12. BanglaMemeX: Advancing Cultural Metaphoric Image Interpretation in Bangla with a Multimodal Explainable Dataset

    Sep 7, 2026Md. Sadman Sakib, Zisan Mahmud, Md. Fahim Arefin +1Figurative Language UnderstandingMultilingual VLM Evaluation

  13. CulturalMenuBench: Probing the Knowledge-Application Gap in Multimodal Culinary Reasoning

    Sep 3, 2026Bo Zeng, Linfeng Gao, Peiqin Lin +9Multimodal ReasoningMultilingual VLM Evaluation

  14. Accurate in space, unreliable in time: how LLMs represent national cultural change

    Sep 1, 2026Yalda Daryani, Miranda Bogen, Madeleine I. G. DaeppLLM EvaluationCultural Evolution

  15. VakyArth: Evaluating Pragmatic Competence in LLMs across Indic Languages

    Sep 1, 2026Usneek Singh, Poorvaja Veera Balaji Kumar, Parth Nanda +4Multilingual Language Model EvaluationLLM Evaluation

  16. MemeCULT-1K: Benchmarking South Asian Cultural Context and Humor Understanding of Multimodal Models

    Sep 1, 2026Tawsif Tashwar Dipto, Mehedi Ahamed, Radib Bin Kabir +5VLM EvaluationMultilingual VLM Evaluation

  17. WorldBench: Culturally Grounded Benchmark for Multilingual Agents

    Sep 1, 2026Leonardo Ranaldi, Sherrie Shen, Jushi Kai +1Cross-Cultural Language Model EvaluationLLM Agent Evaluation

  18. MemeBridge: A Dataset for Benchmarking and Mitigating the Bidirectional Cultural Gap in Meme Interpretation

    Aug 31, 2026Hangxiao Zhu, Suliu Qin, Zhuoyan Li +3Cultural Bias in Language ModelsCultural Knowledge in Language Models

  19. CM2: Multimodal Cultural Reasoning via an Integrated Multi-Agent Framework

    Aug 31, 2026Qi Li, Zhaojie Kang, Yingjie He +6Multi-Agent LLM SystemsMultimodal Reasoning

  20. BavGround: A Benchmark for Regional Cultural Grounding and Dialect Competence in Bavarian

    Aug 13, 2026Jophin John, Michael Hoffmann, Jan Fillies +2Multilingual Language Model EvaluationLLM Grounding

  21. Easy to Complete, Hard to Choose: Investigating LLM Performance on the ProverbIT Benchmark

    Aug 5, 2026Enrico Mensa, Lorenzo Zane, Calogero Jerik Scozzaro +3Figurative Language UnderstandingLLM Evaluation

  22. Cultural Awareness is Represented but Not Decoded: Tracing Mythological Knowledge across 18 Open-Source LLMs

    Aug 3, 2026Iaroslav Chelombitko, Ekaterina Chelombitko, Mika HämäläinenMultilingual Language ModelsLLM Interpretability

  23. MemeBench: What LVLMs Miss When Interpreting Culture-Dependent Memes

    Jul 30, 2026Weihang Wang, Kainan Tu, Jielei Zhang +9VLM EvaluationVision-Language Models

  24. IKS-Instruct: A 24,000-Example Multilingual Dataset for Teaching Language Models Indian Knowledge Systems

    Jul 25, 2026Shwetha Singaravelu, Gayathri Muruganantham, Lakshmi Rajendran +1LLM Fine-TuningCultural Knowledge in Language Models

  25. CultureTalk-ID: A Multi-Task Dialogue Benchmark for Cultural Commonsense in Indonesian Local Languages

    Jul 23, 2026Muhammad Dehan Al Kautsar, Salsabila Pranida, Bilal Elbouardi +1Multilingual Language Model EvaluationMulti-Turn Dialogue Evaluation

  26. LKValues: Aligning Large Language Models with Sri Lankan Societal Values

    Jul 22, 2026Nethmi Muthugala, Supryadi, Surangika Ranathunga +7Multilingual Language Model EvaluationLLM Alignment

  27. CAMMAR: Culture-Aware Matryoshka for Metaphorical Arabic Representations

    Jul 17, 2026Suzan Awinat, Alfonso Ortega del PuenteFigurative Language UnderstandingArabic NLP

  28. MSQA: A Natively Sourced Multilingual and Multicultural SimpleQA Benchmark

    Jul 1, 2026Xianru Chen, Yukai Huang, Mingxiang Chen +6Multilingual Language Model EvaluationLLM Evaluation

  29. Same question, different history: language, national identity, and credit in large language models

    Jun 22, 2026William Guey, Pierrick Bougault, Wei Zhang +2Social Bias in Language ModelsCultural Bias in Language Models

  30. CulMind: Benchmarking Multimodal Understanding and Reasoning in Chinese Cultural Heritage

    Jun 19, 2026Zhangwei Cao, Shuhan Fan, Yuting Wei +5Benchmark ConstructionReasoning Evaluation

  31. NRITYAM: Language Models Meet Art and Heritage of Dance

    Jun 18, 2026Punit Kumar Singh, Niladri Ghosh, Advait Joshiınst +3Multilingual Language Model EvaluationLLM Evaluation

  32. LLMs Infer Cultural Context but Fail to Apply It When Responding

    Jun 16, 2026Yisong Miao, Jian Zhu, Vered ShwartzPragmatic Reasoning in Language ModelsCultural Bias in Language Models

  33. The Culture Funnel: You Can't Align What isn't in the Data

    Jun 11, 2026Ananya Sahu, Mehrnaz Mofakhami, Daniel D'Souza +3Cultural AlignmentCultural Bias in Language Models

  34. Who Brought Easter Eggs to Eid? Auditing LLM-Generated Cultural Translation of Math Word Problems Across Languages and Regions

    Jun 9, 2026Parisa Suchdev, Juniper LovatoMultilingual Language Model EvaluationCultural Bias in Language Models

  35. CCBENCH: Assessing LLM Cultural Competence via Implicitly Signaled Norms using Health Queries

    Jun 8, 2026Vasudha Varadarajan, Akhila Yerukola, Mona T. Diab +1LLM EvaluationCultural Bias in Language Models

  36. ChinaHeritaQA: A Culturally-Grounded Visual Question Answering Dataset for World Heritage Sites in China

    Jun 8, 2026Yi Zhang, Bolei Ma, Yong Cao +3VLM EvaluationVisual Question Answering

  37. The Masked Advantage: Uncovering Local-Language Access to Cultural Knowledge in LLMs

    Jun 5, 2026Yang Zhang, Xiao Fei, Amr Mohamed +6Multilingual Language Model EvaluationLLM Evaluation

  38. SEA-NLI: Natural Language Inference as a Lens into Southeast Asian Cultural Understanding

    Jun 2, 2026Peerawat Chomphooyod, Jian Gang Ngui, Yosephine Susanto +5Multilingual Language Model EvaluationCross-Cultural Language Model Evaluation

  39. CARTE: A Benchmark for Mapping Language Model Knowledge Across France

    Jun 1, 2026Sarah Almeida Carneiro, Christos Xypolopoulos, Xiao Fei +2LLM EvaluationFactual Knowledge in Language Models

  40. CultureForest: Understanding and Evaluating Cultural Norm Grounded Reasoning in LLMs

    Jun 1, 2026Yangfan Ye, Xiaocheng Feng, Jialong Tang +5LLM EvaluationCultural Bias in Language Models

  41. When English Rewrites Local Knowledge: Global Narrative Dominance in Large Language Models

    May 28, 2026Md Arid Hasan, Ruwad Naswan, Farhan Samir +2Multilingual Language Model EvaluationLLM Grounding

  42. ExCAM: Explainable Cultural Awareness Metrics

    May 28, 2026Christoph Leiter, Haiyue Song, Hour Kaing +4LLM EvaluationLanguage Model Generation Evaluation

  43. Cultural Binding Heads in Language Models

    May 27, 2026Avrile Floro, Luca BenedettoLLM InterpretabilityCultural Bias in Language Models

  44. JuICE: A Benchmark for Evaluating LLM-Judge in Identifying Cultural Errors

    May 26, 2026Jiho Jin, Junho Myung, Juhyun Oh +5Multilingual Language Model EvaluationLLM-as-a-Judge

  45. DFKI-MLT at SemEval-2026 TASK 7: Steering Multilingual Models Towards Cultural Knowledge

    May 21, 2026Yusser Al Ghussin, Daniil Gurgurov, Yasser Hamidullah +3Multilingual Language ModelsMultilingual Language Model Evaluation

  46. Cross-Lingual Consensus: Aligning Multilingual Cultural Knowledge via Multilingual Self-Consistency

    May 21, 2026Andrew Ivan Soegeng, Patrick Sutanto, Tan Sang NguyenCultural Bias in Language ModelsCultural Knowledge in Language Models

  47. CrossCult-KIBench: A Benchmark for Cross-Cultural Knowledge Insertion in MLLMs

    May 7, 2026Zhen Zeng, Leijiang Gu, Feng Li +2Knowledge Augmentation for Language ModelsMultimodal Large Language Models

  48. SemEval-2026 Task 7: Everyday Knowledge Across Diverse Languages and Cultures

    May 4, 2026Nedjma Ousidhoum, Junho Myung, Carla Perez-Almendros +27Multilingual Language Model EvaluationLLM Evaluation