Language Model Bias Evaluation

Latest papers 321

All topics
CardsList
  1. New Conditions for Philosophers to Catch the Wave of Citizen Deliberation in the Age of Artificial Intelligence in advance

    Sep 14, 2026Bernard ReberPolitical Bias in Language ModelsLanguage Model Bias Evaluation

  2. Issue Bias in Generative AI Writing Assistance: Political Issues and LLMs in the Swedish 2026 Election

    Sep 14, 2026Bastiaan Bruinsma, Annika Fredén, Paul Röttger +2Political Discourse AnalysisPolitical Bias in Language Models

  3. Can We Trust LLM Judges: A Study of Capability-Dependent Biases and Multi-Judge Ensemble for Bias Calibration

    Sep 14, 2026Gemma Zhang, Prachi Badarayani, Asmi Kumar +2LLM EvaluationLLM-as-a-Judge

  4. Debiasing as a Measurement Intervention: Calibrated Ties and Resolution Loss in LLM-as-a-Judge Evaluation

    Sep 14, 2026Liang Zhao, Yong Wang, Jiangzhe ChenLLM-as-a-JudgeLLM Agent Evaluation

  5. EduFair-Bench: Evaluating Pedagogical Fairness of LLM Tutors Across Student Demographics

    Sep 14, 2026Jiaxu Zhao, Bahar Radmehr, Fares Fawzi +2Generative AI in EducationLanguage Model Bias Evaluation

  6. One Example Is Enough to Pass Fairness Benchmarks: Rethinking Fairness Evaluation for Aligned LLMs

    Sep 14, 2026Naihao Deng, Samee Arif, Shuaichen Chang +2LLM EvaluationLLM Alignment

  7. When Noise Fabricates Bias: The Fragility of LLM-as-a-Judge Bias Measurement under Noisy Text

    Sep 10, 2026DongHyun Ryu, Jaehyeok Lee, YeongJun Hwang +1LLM-as-a-JudgeSocial Bias in Language Models

  8. Reference-Based Bias Detection in LLMs via Relative Representations of Hidden States

    Sep 9, 2026Marek Jeliński, Jan Dubiński, Maciej Chrabaszcz +1LLM AuditingSocial Bias in Language Models

  9. Deep and shallow biases in language models

    Sep 9, 2026An Vo, Vy Tuong Dang, Khai-Nguyen Nguyen +4Social Bias in Language ModelsLanguage Model Bias Evaluation

  10. The Audit Decides the Verdict: Instrument Effects Rival Demographic Bias in LLM Decision Audits

    Sep 8, 2026Siddharth Vohra, Manikandan RavikiranLanguage Model Bias EvaluationDemographic Bias in Language Models

  11. Navigating the digital spectrum: Assessing political bias, stability, and downstream fairness in Large Language Models

    Sep 8, 2026Luka Debevc, Nishan Chatterjee, Antoine Doucet +2Multilingual Language Model EvaluationPolitical Bias in Language Models

  12. FramingQA: Does the Question Shape the Answer? Measuring the Compositional Framing Effect

    Sep 7, 2026Hazel H. Kim, Andrew M. Bean, Guilherme Affonso Ferreira de Camargo +10LLM EvaluationLLM Reliability

  13. WinoQueer-NL: Assessing Bias in Dutch Language Models toward LGBTQ+ Identities

    Sep 2, 2026Jiska Beuk, Gerasimos SpanakisSocial Bias in Language ModelsLanguage Model Bias Evaluation

  14. Right Frame, Wrong Rule: Cultural Cues Expose the Financial Knowledge Gap They Were Meant to Close

    Sep 1, 2026Rania Elbadry, Ahmed Heakl, Saeed Almheiri +12Financial ServicesCultural Bias in Language Models

  15. Authority Bias in Conversational Search Engines for Academic Paper Recommendation

    Aug 31, 2026Uthman Jinadu, Parsa Ghazvinian, Anjila Budathoki +3Language Model Bias EvaluationLarge Language Model-Based Recommendation

  16. LLM-as-a-Demographic: Whom Sociodemographic Prompting Helps, and Whom It Hurts

    Aug 31, 2026Daniela Occhipinti, Andrea Piergentili, Marco GueriniLLM-as-a-JudgeLLM Prompting

  17. Stress-Testing Efficient Responsible-AI Evaluation: When Compute Savings Change Benchmark Conclusions

    Aug 31, 2026Ahmed El Kady, Aravind Narayanan, Rehana Noorani +2LLM EvaluationEnergy-Efficient ML

  18. Evaluating and Mitigating Anti-LGBTQ Biases in German and Multilingual Language Models

    Aug 31, 2026Melina Morch, Daniel BraunMultilingual Language Model EvaluationSocial Bias in Language Models

  19. WildSEEK: Evaluating Language Models for Information-Seeking

    Aug 31, 2026Tanise Ceron, Joachim Baumann, Elisa Bassignana +3LLM Safety BenchmarksLLM Sycophancy

  20. Benevolent Bias in Multi-Turn Human-Agent Dialogue

    Aug 29, 2026Qianqi Liu, Jin Huang, Fethiye Irmak Dogan +1Social Bias in Language ModelsAlgorithmic Bias

  21. It's How You Ask: Gender-Associated Linguistic Bias in LLMs

    Aug 13, 2026Katherine Van Koevering, Anjalie FieldGender Bias in Language ModelsSocial Bias in Language Models

  22. Group Alignment-Induced Sycophancy: A Two-Sided Evaluation of Steerable Pluralistic Alignment

    Aug 12, 2026Haokai Zhao, Yunze Xiao, Weihao Xuan +3LLM SycophancyLLM Alignment

  23. Every Token Counts: Exact Likert-Scale Distributions for Measuring LLM Attitudes and Biases

    Aug 11, 2026Davood Wadi, Mohsen Ghodrat, Matthew PhilpLLM EvaluationCultural Bias in Language Models