Language Model Bias Evaluation

Latest papers 321

All topics
CardsList
  1. The Missing Minimal Pair: Stereotype Evaluation in LLMs

    Oct 6, 2026Nataliya Stepanova, Ivan Titov, Emily Allaway +1Multilingual Language Model EvaluationSocial Bias in Language Models

  2. Counterfactual Auditing of Bias in Open-Source Large Language Models for Clinical Triage

    Oct 1, 2026Manar Aljohani, Brandon Ho, Kenneth McKinley +2Clinical Decision-MakingLanguage Model Bias Evaluation

  3. A Shared Taste for Model-Written Text: The Generator-by-Selector Matrices of "AI-AI Bias" Show No Detectable Own-Model Premium

    Sep 30, 2026Dmitrij ŻatuchinLLM EvaluationLanguage Model Bias Evaluation

  4. MASCRDM: Multi-Agent System for Compliance Risk Detection and Mitigation in Training Process of Large Language Models

    Sep 30, 2026Yan Zhang, Chuming Wei, Ruien Li +3LLM SafetyLanguage Model Bias Evaluation

  5. More Choices, Fewer Decisions: Ordinal-Scale Bias in JEV-like Direct-Decision Models

    Sep 30, 2026Tianxiang Gao, Jinzhe Li, Zhiyuan Li +2LLM EvaluationOrdinal Regression

  6. Whose Voice Survives the Summary? A Voice-Retention Audit of LLM Employee Listening

    Sep 30, 2026Thilo Tamme, Anton Hantel, Bijan Khosrawi-RadText SummarizationSummarization Evaluation

  7. Sense and Sensitivity: Benchmarking LLM Clinical Triage Recommendations with Physician Experts

    Sep 29, 2026Abinitha Gourabathina, Haoran Zhang, Yuexing Hao +2Clinical TriageClinical Decision-Making

  8. Gender bias across LLMs is common and highly heterogeneous

    Sep 29, 2026Edoardo Bolzoni, Valerio CapraroGender Bias in Language ModelsLLM Auditing

  9. Over-Personalization Is a Decision Failure: Generation-Induced Apply Bias in LLMs

    Sep 28, 2026Haeun Jang, Yonghyun Jun, Hwanhee LeePersonalized Language ModelsLLM Decision-Making

  10. RupeeBias: Auditing Demographic Bias in Indian Economic Guidance from Large Language Models

    Sep 25, 2026Pavithra P M Nair, Bhavik Talaviya, Shourya Bhushan +5Language Model Bias EvaluationDemographic Bias in Language Models

  11. Cultural Divergence Preservation: Diagnosing Flattening and Caricature in LLM-Simulated Survey Populations

    Sep 24, 2026Yeeun Chae, Yewon Choi, Seunghyun Lee +1Cultural Bias in Language ModelsLanguage Model Bias Evaluation

  12. Some Dialects Are More Equal Than Others: Non-Prestigious Arabic Dialectal Bias in LLMs

    Sep 21, 2026Mai Mohamed Eida, Ryan Dolan, Paul de Nijs +1Arabic NLPSocial Bias in Language Models

  13. Geopolitical Divisions Across Languages in Large Language Models

    Sep 17, 2026Maxim ChupilkinMultilingual Language Model EvaluationPolitical Bias in Language Models

  14. "If I Had to Buy Just ONE: Galaxy S26 Ultra": Auditing AI-Generated Product Recommendations

    Sep 16, 2026Lucas G. Uberti-Bona Marin, Thales Bertaglia, Giovanni Astante +5Language Model Bias EvaluationLarge Language Model-Based Recommendation

  15. DyMT-ESB: Dynamic Multi-Turn Evaluation of Social Bias in User-LLM Interactions

    Sep 16, 2026Rem Hida, Masahiro Kaneko, Daisuke Oba +2Social Bias in Language ModelsMulti-Turn Dialogue Evaluation

  16. Linguistic Triggers of Gender and Racial Bias in Open-Weight LLMs Applied to Recruitment

    Sep 16, 2026Kosuke Kitahara, Nobuhiro YamaguchiGender Bias in Language ModelsAI-Assisted Decision Making

  17. Whom Do AI Agents Work For? Role Assignment Induces Sponsorship Bias in LLM Recommenders

    Sep 16, 2026Davood Wadi, Yu MaLanguage Model Bias EvaluationLarge Language Model-Based Recommendation

  18. The Role of Implicit and Explicit Demographic Signals in Large Language Model-based Student Assessment

    Sep 15, 2026Donya Rooein, Luca Benedetto, Dirk HovyAI in EducationGenerative AI in Education

  19. How Humans and LLMs Read Gender into "Gender-Neutral" Physical Descriptions

    Sep 14, 2026Yingjia Wan, Lin Lin, Elisa KreissGender Bias in Language ModelsLanguage Model Bias Evaluation