Language Model Bias Evaluation

Latest papers 321

All topics
CardsList
  1. Contaminated Collaboration: Measuring Gender Bias Transfer in LLM-Assisted Student Writing

    Jun 14, 2026Ariyan Hossain, Kazi Kamruzzaman Rabbi, Farig Sadeque +1Gender Bias in Language ModelsGenerative AI in Education

  2. LLM Judges Have Dark Current: A Psychometric Datasheet for LLM-as-a-Judge Evaluation

    Jun 14, 2026Hiroyasu Usami, Keisuke Hara, Ayato Tsuboi +1LLM EvaluationLLM-as-a-Judge

  3. Prior over Evidence: Stereotype-Driven Diagnosis in LLM-Based L2 Pronunciation Feedback

    Jun 13, 2026Rong Wang, Kun SunAudio-Language Model EvaluationLLM Grounding

  4. AmchiBias: Measuring Stereotypical Bias in Goan Identity Groups with a Minimal Pair Dataset in English and Konkani

    Jun 13, 2026Michelle Barbosa, Sebastian Padó, Franziska WeeberMultilingual Language Model EvaluationCultural Bias in Language Models

  5. Beyond Accuracy: Measuring Bias Acknowledgment in Chain-of-Thought Reasoning for Responsible AI Evaluation

    Jun 13, 2026Xian Sun, Wei Gao, Yingshuo Wang +9Language Model Generation EvaluationCoT Evaluation

  6. Characterizing Cultural Localization in AI-Generated Stories

    Jun 12, 2026Shaily Bhatt, Supriti Vijay, Jeremiah Milbauer +1Cultural Bias in Language ModelsLanguage Model Bias Evaluation

  7. A Computational Audit of Demographic Association Encoding in ClinicalBERT Language Predictions

    Jun 12, 2026Kehinde Temitayo SoetanLanguage Model Bias EvaluationDemographic Bias in Language Models

  8. A Two-Stage Statistical Framework for Evaluating Associative Interference in Large Language Models

    Jun 12, 2026Achraf Cohen, Andrew KincaidGender Bias in Language ModelsLanguage Model Bias Evaluation

  9. Harsher on Male? Evaluating LLMs on Gender-Asymmetric Moral Framing Across Diverse Conflict Scenarios

    Jun 12, 2026Guangzong Si, Dong Wang, Zhenhao Li +3Gender Bias in Language ModelsMoral Reasoning in Language Models

  10. LLMs Contain Multitudes: How Deployment Context Reshapes Model-Level Preferences and Values

    Jun 11, 2026Filip Trhlik, Aoife O'Flynn, Angela Yu +2LLM EvaluationLanguage Model Bias Evaluation

  11. Polar: A Benchmark for Evaluating Political Bias in LLMs

    Jun 11, 2026Sangho Kim, Heejin Kim, Yoonhee Park +2Multilingual Language Model EvaluationPolitical Bias in Language Models

  12. Reassessing High-Performing LLMs on Polish Medical Exams: True Competence or Bias-Driven Performance?

    Jun 10, 2026Antoni Lasik, Jakub Pokrywka, Łukasz Grzybowski +7LLM EvaluationLLM Reliability

  13. Beyond Third-Person Audits: Situated Interaction Auditing for User-Centered LLM Bias Research

    Jun 10, 2026Andrés Abeliuk, Cinthia Sanchez Macias, Valentina Alarcón +2Gender Bias in Language ModelsSocial Bias in Language Models

  14. AI Coding Agents in Social Science: Methodologically Diverse, Empirically Consistent, Interpretively Vulnerable

    Jun 9, 2026Meysam Alizadeh, Fabrizio Gilardi, Mohsen Mosleh +1AI Agent ReliabilityAI Coding Agents

  15. Pareto-Guided Teacher Alignment for Fair Personalized Text Generation

    Jun 8, 2026Tunazzina IslamLanguage Model Bias EvaluationMulti-Objective Language Model Alignment

  16. SEF-CLGC at SemEval-2026 Task 11: Logical Notation Impact on Language Model Performance

    Jun 8, 2026Hanna Abi Akl, Fabien Gandon, Catherine Faron +1Logical ReasoningSymbolic Reasoning

  17. Friend or Foe? Language as an ideological switch in open-weight LLMs under Russian disinformation stress

    Jun 7, 2026Anna Małgorzata Kamińska, Tetiana KlyninaMultilingual Language Model EvaluationPolitical Bias in Language Models

  18. Neutrality Bites: Gender Representation in AI-Generated Animal Stories

    Jun 6, 2026Imani Finkley, Yuanxi Li, Melanie WalshGender Bias in Language ModelsSocial Bias in Language Models

  19. From 'May' to 'Is': Certainty Distortion in Language Model Rewriting

    Jun 6, 2026Catarina G Belem, Shang Wu, Hongyu Yao +3Scientific CommunicationLanguage Model Calibration

  20. Stress-testing medical large language models reveals latent safety pathology beyond benchmark accuracy

    Jun 6, 2026Yuan Shen, Xiaojun Wu, Linghua YuLLM EvaluationLanguage Model Safety Evaluation

  21. Whose Norms? Disentangling Cultural and Personal Alignment in Large Language Models

    Jun 5, 2026Angana Borah, Isabelle Augenstein, Rada MihalceaLLM AlignmentNormative Conformity in Language Models

  22. The Geography of Algorithmic Judgment: LLM Intermediaries, Place Identity, and Racial Steering in Housing Search

    Jun 4, 2026Hana Samad, Trung Lam, Christoph Mügge-Durum +1LLM AuditingSocial Bias in Language Models

  23. From Self to Other: Evaluating Demographic Perspective-Taking in LLM Hate Speech Annotation

    Jun 4, 2026Paloma Piot, Javier ParaparLLM-Assisted AnnotationHate Speech Detection

  24. Large Language Models are Perplexed by some Political Parties

    Jun 4, 2026Paul Lerner, François YvonMultilingual Language Model EvaluationPolitical Bias in Language Models

  25. TriEval: A Resource-Efficient Pipeline for LLM Bias, Toxicity, and Truthfulness Assessment

    Jun 2, 2026Akshatha Srikantha, Manpreet Singh, Yash Jajoo +1LLM EvaluationLanguage Model Safety Evaluation

  26. Topics as Proxies for Sociodemographics: How Conversational Context Affects LLM Answers

    Jun 1, 2026Vera Neplenbroek, Gabriele Sarti, Arianna Bisazza +1Social Bias in Language ModelsLanguage Modeling

  27. CultureForest: Understanding and Evaluating Cultural Norm Grounded Reasoning in LLMs

    Jun 1, 2026Yangfan Ye, Xiaocheng Feng, Jialong Tang +5LLM EvaluationCultural Bias in Language Models

  28. Identifying High-Confidence Social Biases in LLMs for Trustworthy Conversational Tutoring Agents

    Jun 1, 2026Aitor Arronte Alvarez, Naiyi Xie FinchamIntelligent Tutoring SystemsSocial Bias in Language Models