Language Model Bias Evaluation

Latest papers 321

All topics
CardsList
  1. Large Language Models Exhibit Normative Conformity

    Apr 21, 2026Mikako Bito, Keita Nishimoto, Kimitaka Asatani +1Normative Conformity in Language ModelsSocial Bias in Language Models

  2. Location Not Found: Exposing Implicit Local and Global Biases in Multilingual LLMs

    Apr 21, 2026Guy Mor-Lan, Omer Goldman, Matan Eyal +6Multilingual Language ModelsMultilingual Language Model Evaluation

  3. Beyond Semantic Similarity: A Component-Wise Evaluation Framework for Medical Question Answering Systems with Health Equity Implications

    Apr 21, 2026Abu Noman Md Sakib, Md. Main Oddin Chisty, Zijie ZhangLLM Answer VerificationHealthcare

  4. AlignCultura: Towards Culturally Aligned Large Language Models?

    Apr 21, 2026Gautam Siddharth Kashyap, Mark Dras, Usman NaseemCross-Cultural Language Model EvaluationCultural Alignment

  5. Investigating Counterfactual Unfairness in LLMs towards Identities through Humor

    Apr 20, 2026Shubin Kim, Yejin Son, Junyeong Park +6Social Bias in Language ModelsLanguage Model Bias Evaluation

  6. First, Do No Harm (With LLMs): Mitigating Racial Bias via Agentic Workflows

    Apr 20, 2026Sihao Xing, Zaur GoulievHealthcareSocial Bias in Language Models

  7. VIBE: Voice-Induced open-ended Bias Evaluation for Large Audio-Language Models via Real-World Speech

    Apr 19, 2026Yi-Cheng Lin, Yusuke Hirota, Sung-Feng Huang +1Audio-Language Model EvaluationGender Bias in Language Models

  8. Bias in the Loop: Auditing LLM-as-a-Judge for Software Engineering

    Apr 18, 2026Zixiao Zhao, Amirreza Esmaeili, Fatemeh FardSoftware EngineeringLLM-as-a-Judge

  9. Expressing Social Emotions: Misalignment Between LLMs and Human Cultural Emotion Norms

    Apr 18, 2026Sree Bhattacharyya, Manas Mehta, Leona Chen +4LLM EvaluationCultural Bias in Language Models

  10. Mitigating Prompt-Induced Cognitive Biases in General-Purpose AI for Software Engineering

    Apr 18, 2026Francesco Sovrano, Gabriele Dominici, Alberto BacchelliSoftware EngineeringLLM Prompting

  11. Polarization by Default: Auditing Recommendation Bias in LLM-Based Content Curation

    Apr 17, 2026Nicolò Pagan, Christopher Barrie, Chris Andrew Bail +1LLM PromptingSocial Bias in Language Models

  12. Context Over Content: Exposing Evaluation Faking in Automated Judges

    Apr 16, 2026Manan Gupta, Inderjeet Nair, Lu Wang +1LLM-as-a-JudgeLanguage Model Safety Evaluation

  13. SPAGBias: Uncovering and Tracing Structured Spatial Gender Bias in Large Language Models

    Apr 16, 2026Binxian Su, Haoye Lou, Shucheng Zhu +4Gender Bias in Language ModelsLanguage Model Bias Evaluation

  14. VoxSafeBench: Not Just What Is Said, but Who, How, and Where

    Apr 16, 2026Yuxiang Wang, Hongyu Liu, Yijiang Xu +9Language Model Safety EvaluationPrivacy Leakage in Language Models

  15. Benchmarking Bengali Dialectal Bias: A Multi-Stage Framework Integrating RAG-Based Translation and Human-Augmented RLAIF

    Mar 22, 2026K. M. Jubair Sami, Dipto Sumit, Ariyan Hossain +1Social Bias in Language ModelsLanguage Model Bias Evaluation

  16. MultiwayPAM: Multiway Partitioning Around Medoids for LLM-as-a-Judge Score Analysis

    Mar 11, 2026Chihiro Watanabe, Jingyu SunLLM-as-a-JudgeClustering

  17. Toward Robust LLM-Based Judges: Taxonomic Bias Evaluation and Debiasing Optimization

    Mar 9, 2026Hongli Zhou, Hui Huang, Rui Zhang +5LLM-as-a-JudgeSocial Bias in Language Models

  18. FairJudge: An Adaptive, Debiased, and Consistent LLM-as-a-Judge

    Feb 6, 2026Bo Yang, Lanfei Feng, Yunkui Chen +3LLM EvaluationLLM-as-a-Judge

  19. Investigating Social Bias Changes in Quantized Language Models

    Feb 5, 2026Stanley Z. Hua, Sanae Lotfi, Irene Y. ChenLLM QuantizationSocial Bias in Language Models

  20. Are LLM Evaluators Really Narcissists? Sanity Checking Self-Preference Evaluations

    Jan 30, 2026Dani Roytburg, Matthew Bozoukov, Matthew Nguyen +3LLM-as-a-JudgeLanguage Model Generation Evaluation

  21. SONIC-O1: A Real-World Benchmark for Evaluating Multimodal Large Language Models on Audio-Video Understanding

    Jan 29, 2026Ahmed Y. Radwan, Christos Emmanouilidis, Hina Tabassum +2Audio-Language Model EvaluationMultimodal Grounding

  22. White-Box Sensitivity Auditing with Steering Vectors

    Jan 23, 2026Hannah Cyberey, Yangfeng Ji, David EvansAlgorithmic AuditingLLM Auditing