Language Model Bias Evaluation

Latest papers 321

All topics
CardsList
  1. IndoBias: A Dual Track Culturally Grounded Benchmark for LLMs Bias Evaluation in Indonesian Languages

    May 31, 2026Ikhlasul Akmal Hanif, Muhammad Falensi Azmi, Filbert Aurelian Tjiaranata +2Multilingual Language Model EvaluationCultural Bias in Language Models

  2. Isolating LLM Lexical Bias: A Curation-Free Triangulated Metric for Preference-Stage Learning

    May 29, 2026Xiaoyang Ming, Jose Hernandez, Thomas Stephan JuzekLLM AlignmentLLM Fine-Tuning

  3. A Visually Impaired Assistance Benchmark for VLM-as-a-Judge Evaluation

    May 29, 2026Yi Zhao, Siqi Wang, Zhe Hu +2VLM EvaluationLLM-as-a-Judge

  4. Anchoring LLM Gender Bias to Human Baselines: A Cross-Lingual Audit

    May 29, 2026Jiwoo Choi, Seonwoo Ahn, Tongxin Zhang +1Gender Bias in Language ModelsMultilingual Language Model Evaluation

  5. COFT: Counterfactual-Conformal Decoding for Fair Chain-of-Thought Reasoning in Large Language Models

    May 28, 2026Arya Fayyazi, Mehdi Kamal, Massoud PedramSocial Bias in Language ModelsCounterfactual Fairness

  6. When English Rewrites Local Knowledge: Global Narrative Dominance in Large Language Models

    May 28, 2026Md Arid Hasan, Ruwad Naswan, Farhan Samir +2Multilingual Language Model EvaluationLLM Grounding

  7. Label Over Logic? How Source Cues Bias Human Fallacy Judgments More Than LLMs

    May 28, 2026Mahjabin Nahar, Nafis Irtiza Tripto, Aiping Xiong +2LLM EvaluationLanguage Model Bias Evaluation

  8. PRAIB: Peer Review AI Benchmark of Behaviour of LLM-Assisted Reviewing

    May 28, 2026Krzysztof Żurawicki, Julia Farganus, Arkadiusz Gaweł +2LLM EvaluationScholarly Peer Review

  9. Persona Prompting in Multimodal Urban Perception: Descriptive Convergence and Interpretive Variation

    May 27, 2026Neemias da Silva, Matt Ratto, Myriam Delgado +3Multimodal Large Language ModelsLanguage Model Bias Evaluation

  10. Do LLMs Favor Their Providers? Measuring Vertical Integration Bias in Code Generation

    May 27, 2026Melih Catal, Alex Wolf, Tiago Ferreiro Matos +2Agentic Code GenerationAlgorithmic Bias

  11. DEPART: DEcomposing PARiTy across Multilingual LLMs

    May 27, 2026Manan Uppadhyay, Prashant Kodali, Pranjal Chitale +3Multilingual Language Model EvaluationCross-Lingual Reasoning in Language Models

  12. Examining Agents' Bias Amplification versus Suppression in Multi-Agent Systems

    May 27, 2026Zejian Eric Wu, Zhongyi Jiang, Yuan Zhuang +1Multi-Agent LLM SystemsAlgorithmic Fairness

  13. MIRA: A Bilingual Benchmark for Medical Information Response Audit

    May 27, 2026Mengyu Xu, Qiaoxin Yang, Qianqian Wang +3Multilingual Language Model EvaluationHealthcare

  14. Reward Bias Substitution: Single-Axis Bias Mitigations Redirect Optimization Pressure

    May 27, 2026Max Lamparth, Daniel Fein, Andreas Haupt +2Reward ModelingRL for Language Models

  15. LLM-Ideoplasticity: Measuring Ideological Plasticity in the Political Behavior of LLMs as a Context-Conditioned Distribution

    May 26, 2026Adib Sakhawat, Syed Rifat Raiyan, Tahsin Islam +3Political Bias in Language ModelsLanguage Model Bias Evaluation

  16. Insidious by Design: Implications of Large Language Model algorithmic bias for the Global South

    May 26, 2026Sioux McKenna, Nompilo TshumaGender Bias in Language ModelsCultural Bias in Language Models

  17. LLM-as-a-Reviewer: Benchmarking Their Ability, Divergence, and Prompt Injection Resistance as Paper Reviewers

    May 25, 2026Lingyao Li, Junjie Xiong, Changjia Zhu +5LLM EvaluationLLM-as-a-Judge

  18. Side-by-side Comparison Amplifies Dialect Bias in Language Models

    May 23, 2026Kritee Kondapally, Claire J. Smerdon, Pooja C. Patel +5Social Bias in Language ModelsAlgorithmic Fairness

  19. Omissive Bias in Religious Representation: Benchmarking LLM Answers to Everyday Ethical Decision-making

    May 23, 2026David Wingate, Sheryl Carty, Joshua Coates +13Moral Reasoning in Language ModelsSocial Bias in Language Models

  20. When AI Takes Sides on Questions of Faith: Persistent Asymmetries in AI-Mediated Faith Guidance

    May 21, 2026Brett Israelsen, Sheryl Carty, Josh Coates +3Social Bias in Language ModelsLanguage Model Bias Evaluation

  21. Evaluating Commercial AI Chatbots as News Intermediaries

    May 21, 2026Mirac Suzgun, Emily Shen, Federico Bianchi +5LLM EvaluationQuestion Answering

  22. Reducing Political Manipulation with Consistency Training

    May 21, 2026Long Phan, Devin Kim, Alexander Pan +3Social Bias in Language ModelsPolitical Bias in Language Models

  23. Mechanics of Bias and Reasoning: Interpreting the Impact of Chain-of-Thought Prompting on Gender Bias in LLMs

    May 19, 2026Edie Pearman, Sophia Osborne, Mira Kandlikar-Bloch +3Gender Bias in Language ModelsLLM Interpretability

  24. Occupational Prompting Reveals Cultural Bias in Large Language Models

    May 19, 2026Maksim E. Eren, Andrea Brennen, Ryan C. Barron +1LLM PromptingSocial Bias in Language Models

  25. Diagnosing Korean-Language LLM Political Bias via Census-Grounded Agent Simulation

    May 18, 2026Sungwoo KangPolitical Bias in Language ModelsLanguage Model Calibration

  26. GPF-LiveNews: A Streaming Evaluation Protocol for Group-Conditioned Framing in Large Language Models

    May 16, 2026Mohd Ariful Haque, Fahad Rahman, Kishor Datta Gupta +1LLM EvaluationLLM Auditing