Cultural Knowledge in Language Models

Latest papers 77

All topics
CardsList
  1. Artificial Intelligence and the New Science of Culture

    Oct 5, 2026Douglas R. Guilbeault, Bhargav Srinivasa Desikan, James A. EvansCultural EvolutionComputational Social Science

  2. Knowing the Rules, Applying the Rules: Evaluating Language Models on Traditional Chinese Bazi

    Oct 5, 2026Jiulin Li, Ping HuangLLM EvaluationCultural Knowledge in Language Models

  3. AraDynFact: Dynamic Evaluation of Factual Knowledge in Arabic

    Sep 28, 2026Ignacio Iacobacci, Faroq Altam, Zhaozhi Qian +1LLM EvaluationArabic NLP

  4. CRISP: Cultural Reward Modeling for Implicit Situated Propriety

    Sep 28, 2026Zekun Yuan, Yangfan Ye, Baohang Li +6Reward ModelingRL for Language Models

  5. Recognized but Not Produced: A Generation Benchmark for Culturally Specific Kinship Terms

    Sep 22, 2026Sahil Pardasani, Madhusudan SinghMultilingual Language Model EvaluationLanguage Model Generation Evaluation

  6. FineWeb-CLaR: Culture, Language, and Region Annotations for Benchmark-Aligned Corpus Auditing

    Sep 21, 2026Yusser Al Ghussin, Eva Gavaller, Cristina España-Bonet +2Multilingual Language Model EvaluationLLM Auditing

  7. MUSE: Benchmarking Large Vision-Language Models on Multi-Modal Understanding in Situated Education

    Sep 16, 2026Luyao Zhu, Xun Wei Yee, Wei Li +2VLM EvaluationLarge Vision-Language Models

  8. Cultural Competence in Context: A Large Language Model Passes the Turing Test in Finland

    Sep 16, 2026Otto Segersven, Pentti HenttonenMultilingual Language Model EvaluationLLM Evaluation

  9. Knowledge-Graph Based Augmentation versus Retrieval Augmented Generation for Cultural-Related Question Answering

    Sep 16, 2026Pablo Poulenard, Yannis Karmim, Valentin BarrièreRetrieval-Augmented GenerationGraph Retrieval-Augmented Generation

  10. Calibrated Ambiguity in Multimodal Language Models: Humans reach for cultural references, while models describe the picture

    Sep 14, 2026Cody Kommers, Mingrui Ye, Evelyn Gius +4Pragmatic Reasoning in Language ModelsMultimodal Large Language Models

  11. Multilingual in Name Only? Cultural and Linguistic Weaknesses of LLMs in Urdu

    Sep 12, 2026Farah Adeeba, Abdul Rafae Khan, Rajesh Bhatt +1Multilingual Language Model EvaluationCultural Knowledge in Language Models

  12. BanglaMemeX: Advancing Cultural Metaphoric Image Interpretation in Bangla with a Multimodal Explainable Dataset

    Sep 7, 2026Md. Sadman Sakib, Zisan Mahmud, Md. Fahim Arefin +1Figurative Language UnderstandingMultilingual VLM Evaluation

  13. CulturalMenuBench: Probing the Knowledge-Application Gap in Multimodal Culinary Reasoning

    Sep 3, 2026Bo Zeng, Linfeng Gao, Peiqin Lin +9Multimodal ReasoningMultilingual VLM Evaluation

  14. Accurate in space, unreliable in time: how LLMs represent national cultural change

    Sep 1, 2026Yalda Daryani, Miranda Bogen, Madeleine I. G. DaeppLLM EvaluationCultural Evolution

  15. VakyArth: Evaluating Pragmatic Competence in LLMs across Indic Languages

    Sep 1, 2026Usneek Singh, Poorvaja Veera Balaji Kumar, Parth Nanda +4Multilingual Language Model EvaluationLLM Evaluation

  16. MemeCULT-1K: Benchmarking South Asian Cultural Context and Humor Understanding of Multimodal Models

    Sep 1, 2026Tawsif Tashwar Dipto, Mehedi Ahamed, Radib Bin Kabir +5VLM EvaluationMultilingual VLM Evaluation

  17. WorldBench: Culturally Grounded Benchmark for Multilingual Agents

    Sep 1, 2026Leonardo Ranaldi, Sherrie Shen, Jushi Kai +1Cross-Cultural Language Model EvaluationLLM Agent Evaluation

  18. MemeBridge: A Dataset for Benchmarking and Mitigating the Bidirectional Cultural Gap in Meme Interpretation

    Aug 31, 2026Hangxiao Zhu, Suliu Qin, Zhuoyan Li +3Cultural Bias in Language ModelsCultural Knowledge in Language Models

  19. CM2: Multimodal Cultural Reasoning via an Integrated Multi-Agent Framework

    Aug 31, 2026Qi Li, Zhaojie Kang, Yingjie He +6Multi-Agent LLM SystemsMultimodal Reasoning

  20. BavGround: A Benchmark for Regional Cultural Grounding and Dialect Competence in Bavarian

    Aug 13, 2026Jophin John, Michael Hoffmann, Jan Fillies +2Multilingual Language Model EvaluationLLM Grounding

  21. Easy to Complete, Hard to Choose: Investigating LLM Performance on the ProverbIT Benchmark

    Aug 5, 2026Enrico Mensa, Lorenzo Zane, Calogero Jerik Scozzaro +3Figurative Language UnderstandingLLM Evaluation

  22. Cultural Awareness is Represented but Not Decoded: Tracing Mythological Knowledge across 18 Open-Source LLMs

    Aug 3, 2026Iaroslav Chelombitko, Ekaterina Chelombitko, Mika HämäläinenMultilingual Language ModelsLLM Interpretability

  23. MemeBench: What LVLMs Miss When Interpreting Culture-Dependent Memes

    Jul 30, 2026Weihang Wang, Kainan Tu, Jielei Zhang +9VLM EvaluationVision-Language Models

  24. IKS-Instruct: A 24,000-Example Multilingual Dataset for Teaching Language Models Indian Knowledge Systems

    Jul 25, 2026Shwetha Singaravelu, Gayathri Muruganantham, Lakshmi Rajendran +1LLM Fine-TuningCultural Knowledge in Language Models