Language Model Bias Evaluation

Latest papers 321

All topics
CardsList
  1. Multimodal Large Language Models as Synthetic Participants in Video-Based Studies: An Evaluation

    May 1, 2026Prabal Shrestha, Bohan Jiang, Haoning Xue +2Multimodal Large Language ModelsLanguage Model Bias Evaluation

  2. Political Bias Audits of LLMs Capture Sycophancy to the Inferred Auditor

    Apr 30, 2026Petter Törnberg, Michelle SchimmelLLM SycophancyPolitical Bias in Language Models

  3. Mapping how LLMs debate societal issues when shadowing human personality traits, sociodemographics and social media behavior

    Apr 30, 2026Ali Aghazadeh Ardebili, Massimo StellaSocial Bias in Language ModelsLanguage Model Bias Evaluation

  4. The Digital Afterlife of Empires: Four Language Models Converge on the Same Imperial Cartography of Writing

    Apr 30, 2026Hiroki FukuiMultilingual Language ModelsCultural Bias in Language Models

  5. Debiasing Reward Models via Causally Motivated Inference-Time Intervention

    Apr 30, 2026Kazutoshi Shinoda, Kosuke Nishida, Kyosuke NishidaReward ModelingLLM Alignment

  6. Progressing beyond Art Masterpieces or Touristic Clichés: how to assess your LLMs for cultural alignment?

    Apr 28, 2026António Branco, João Silva, Nuno Marques +10Cultural AlignmentCultural Bias in Language Models

  7. Geographic Bias and Diversity in AI Evaluation

    Apr 28, 2026Zilong Liu, Krzysztof Janowicz, Gengchen Mai +2Algorithmic BiasLanguage Model Bias Evaluation

  8. Assessing Y-Axis Influence: Bias in Multimodal Language Models on Chart-to-Table Translation

    Apr 27, 2026Seok Hwan Song, Azher Ahmed Efat, Wallapak TavanapongData VisualizationMultimodal Large Language Models

  9. A Multi-Dimensional Audit of Politically Aligned Large Language Models

    Apr 27, 2026Lisa Korver, Mohamed Mostagir, Sherief RedaLLM AuditingPolitical Bias in Language Models

  10. Multi-Dimensional Evaluation of Sustainable City Trips with LLM-as-a-Judge and Human-in-the-Loop

    Apr 27, 2026Ashmi Banerjee, Adithi Satish, Wolfgang Wörndl +1LLM EvaluationLLM-as-a-Judge

  11. Representational Harms in LLM-Generated Narratives Against Global Majority Nationalities

    Apr 24, 2026Ilana Nguyen, Harini Suresh, Thema Monroe-White +1Cultural Bias in Language ModelsLanguage Model Bias Evaluation

  12. Quantifying and Mitigating Self-Preference Bias of LLM Judges

    Apr 24, 2026Jinming Yang, Zheng Hu, Chuxian Qiu +3LLM-as-a-JudgeLanguage Model Bias Evaluation

  13. When Cow Urine Cures Constipation on YouTube: Limits of LLMs in Detecting Culture-specific Health Misinformation

    Apr 23, 2026Anamta Khan, Ratna Kandala, Deepti +2LLM PromptingAutomated Fact-Checking

  14. Why are all LLMs Obsessed with Japanese Culture? On the Hidden Cultural and Regional Biases of LLMs

    Apr 23, 2026Joseba Fernandez de Landa, Carla Perez-Almendros, Jose Camacho-ColladosMultilingual Language Model EvaluationCultural Bias in Language Models

  15. Measuring Opinion Bias and Sycophancy via LLM-based Persuasion

    Apr 23, 2026Rodrigo Nogueira, Giovana Kerche Bonás, Thales Sales Almeida +7LLM SycophancyLLM Auditing

  16. Ideological Bias in LLMs' Economic Causal Reasoning

    Apr 23, 2026Donggyu Lee, Hyeok Yun, Jungwon Kim +4Political Bias in Language ModelsLanguage Model Bias Evaluation

  17. When Bigger Isn't Better: A Comprehensive Fairness Evaluation of Political Bias in Multi-News Summarisation

    Apr 23, 2026Nannan Huang, Iffat Maab, Junichi YamagishiSocial Bias in Language ModelsPolitical Bias in Language Models

  18. Intersectional Fairness in Large Language Models

    Apr 22, 2026Chaima Boufaied, Ronnie De Souza Santos, Ann BarcombAlgorithmic FairnessLanguage Model Bias Evaluation