Social Bias in Language Models

Latest papers 126

All topics
CardsList
  1. Social Bias in LLM-Generated Code: Benchmark and Mitigation

    May 1, 2026Fazle Rabbi, Lin Ling, Song Wang +1Social Bias in Language ModelsAgentic Code Generation

  2. Mapping how LLMs debate societal issues when shadowing human personality traits, sociodemographics and social media behavior

    Apr 30, 2026Ali Aghazadeh Ardebili, Massimo StellaSocial Bias in Language ModelsLanguage Model Bias Evaluation

  3. Analyzing LLM Reasoning to Uncover Mental Health Stigma

    Apr 27, 2026Sreehari Sankar, Aliakbar Nafar, Mona Barman +8LLM EvaluationSocial Bias in Language Models

  4. When Bigger Isn't Better: A Comprehensive Fairness Evaluation of Political Bias in Multi-News Summarisation

    Apr 23, 2026Nannan Huang, Iffat Maab, Junichi YamagishiSocial Bias in Language ModelsPolitical Bias in Language Models

  5. Whose Story Gets Told? Positionality and Bias in LLM Summaries of Life Narratives

    Apr 22, 2026Melanie Subbiah, Haaris Mian, Nicholas Deas +3Gender Bias in Language ModelsLLM Auditing

  6. Culturally uneven urban perception in large language models

    Apr 21, 2026Rong Zhao, Wanqi Liu, Zhizhou Sha +3VLM EvaluationSocial Bias in Language Models

  7. Large Language Models Exhibit Normative Conformity

    Apr 21, 2026Mikako Bito, Keita Nishimoto, Kimitaka Asatani +1Normative Conformity in Language ModelsSocial Bias in Language Models

  8. Investigating Counterfactual Unfairness in LLMs towards Identities through Humor

    Apr 20, 2026Shubin Kim, Yejin Son, Junyeong Park +6Social Bias in Language ModelsLanguage Model Bias Evaluation

  9. First, Do No Harm (With LLMs): Mitigating Racial Bias via Agentic Workflows

    Apr 20, 2026Sihao Xing, Zaur GoulievHealthcareSocial Bias in Language Models

  10. Calibrated? Not for Everyone: How Sexual Orientation and Religious Markers Distort LLM Accuracy and Confidence in Medical QA

    Apr 19, 2026Alberto Testoni, Iacer CalixtoHealthcareSocial Bias in Language Models

  11. VIBE: Voice-Induced open-ended Bias Evaluation for Large Audio-Language Models via Real-World Speech

    Apr 19, 2026Yi-Cheng Lin, Yusuke Hirota, Sung-Feng Huang +1Audio-Language Model EvaluationGender Bias in Language Models

  12. BIASEDTALES-ML: A Multilingual Dataset for Analyzing Narrative Attribute Distributions in LLM-Generated Stories

    Apr 18, 2026Yuxuan Ouyang, yingfeng luo, JingBo Zhu +1Multilingual Language Model EvaluationSocial Bias in Language Models

  13. Polarization by Default: Auditing Recommendation Bias in LLM-Based Content Curation

    Apr 17, 2026Nicolò Pagan, Christopher Barrie, Chris Andrew Bail +1LLM PromptingSocial Bias in Language Models

  14. Benchmarking Bengali Dialectal Bias: A Multi-Stage Framework Integrating RAG-Based Translation and Human-Augmented RLAIF

    Mar 22, 2026K. M. Jubair Sami, Dipto Sumit, Ariyan Hossain +1Social Bias in Language ModelsLanguage Model Bias Evaluation

  15. Toward Robust LLM-Based Judges: Taxonomic Bias Evaluation and Debiasing Optimization

    Mar 9, 2026Hongli Zhou, Hui Huang, Rui Zhang +5LLM-as-a-JudgeSocial Bias in Language Models

  16. Investigating Social Bias Changes in Quantized Language Models

    Feb 5, 2026Stanley Z. Hua, Sanae Lotfi, Irene Y. ChenLLM QuantizationSocial Bias in Language Models

  17. Knowing Bias, Doing Better: Mitigating Social Bias in LLMs via Know-Bias Neuron Enhancement

    Jan 29, 2026Jinhao Pan, Chahat Raj, Anjishnu Mukherjee +4Debiased MLSocial Bias in Language Models

  18. White-Box Sensitivity Auditing with Steering Vectors

    Jan 23, 2026Hannah Cyberey, Yangfeng Ji, David EvansAlgorithmic AuditingLLM Auditing

  19. Adaptive Generation of Bias-Eliciting Questions for LLMs

    Oct 14, 2025Robin Staab, Jasper Dekoninck, Maximilian Baader +1Social Bias in Language ModelsLanguage Model Bias Evaluation

  20. Fair-GPTQ: Bias-Aware Quantization for Large Language Models

    Sep 18, 2025Irina Proskurina, Guillaume Metzler, Julien VelcinLLM QuantizationSocial Bias in Language Models

  21. BiasGym: A Simple and Generalizable Framework for Analyzing and Removing Biases through Injection

    Aug 12, 2025Sekh Mainul Islam, Nadav Borenstein, Siddhesh Milind Pawar +3Social Bias in Language ModelsLLM Interpretability