Demographic Bias in Language Models

Latest papers 80

All topics
CardsList
  1. Representational Harms in LLM-Generated Narratives Against Global Majority Nationalities

    Apr 24, 2026Ilana Nguyen, Harini Suresh, Thema Monroe-White +1Cultural Bias in Language ModelsLanguage Model Bias Evaluation

  2. Measuring and Mitigating Persona Distortions from AI Writing Assistance

    Apr 24, 2026Paul Röttger, Kobi Hackenburg, Hannah Rose Kirk +1Trust in AIDemographic Bias in Language Models

  3. From If-Statements to ML Pipelines: Revisiting Bias in Code-Generation

    Apr 23, 2026Minh Duc Bui, Xenia Heilmann, Mattia Cerrato +2Algorithmic BiasCode Generation Evaluation

  4. Intersectional Fairness in Large Language Models

    Apr 22, 2026Chaima Boufaied, Ronnie De Souza Santos, Ann BarcombAlgorithmic FairnessLanguage Model Bias Evaluation

  5. Surrogate modeling for interpreting black-box LLMs in medical predictions

    Apr 22, 2026Changho Han, Songsoo Kim, Dong Won Kim +4Surrogate ModelingLLM Interpretability

  6. Whose Story Gets Told? Positionality and Bias in LLM Summaries of Life Narratives

    Apr 22, 2026Melanie Subbiah, Haaris Mian, Nicholas Deas +3Gender Bias in Language ModelsLLM Auditing

  7. Calibrated? Not for Everyone: How Sexual Orientation and Religious Markers Distort LLM Accuracy and Confidence in Medical QA

    Apr 19, 2026Alberto Testoni, Iacer CalixtoHealthcareSocial Bias in Language Models

  8. Multi-Perspective LLM Annotations for Valid Analyses in Subjective Tasks

    Mar 22, 2026Navya Mehrotra, Adam Visokay, Kristina GligorićAnnotator DisagreementLLM-Assisted Annotation

  9. Knowing Bias, Doing Better: Mitigating Social Bias in LLMs via Know-Bias Neuron Enhancement

    Jan 29, 2026Jinhao Pan, Chahat Raj, Anjishnu Mukherjee +4Debiased MLSocial Bias in Language Models

  10. Tracing the Latent Threads: A Mechanistic Study of How LLMs Represent and Operationalize Race and Ethnicity Cues

    Jan 19, 2026Shiyue Hu, Ruizhe Li, Yanjun GaoLLM InterpretabilityMechanistic Interpretability

  11. Safety Is Not Universal: The Selective Safety Trap in LLM Alignment

    Jan 7, 2026Iago Alves Brito, Walcy Santos Rezende Rios, Julia Soares Dollis +2LLM Safety BenchmarksLLM Alignment

  12. Audit Me If You Can: Query-Efficient Active Fairness Auditing of Black-Box LLMs

    Jan 6, 2026David Hartmann, Lena Pohlmann, Lelia Hanslik +3LLM AuditingAlgorithmic Fairness

  13. Improving Fairness of Large Language Model-Based ICU Mortality Prediction via Case-Based Prompting

    Dec 17, 2025Gangxiong Zhang, Yongchao Long, Yuxi Zhou +2Algorithmic FairnessFew-Shot Prompting

  14. Behavioral Coherence: A Method for Sensitive-Domain LLM Evaluation

    Dec 15, 2025Anika Sharma, Malavika Mampally, Chidaksh Ravuru +2Language Model Bias EvaluationDemographic Bias in Language Models

  15. Which Demographics do LLMs Default to During Annotation?

    Oct 11, 2024Johannes Schäfer, Aidan Combs, Christopher Bagdon +9LLM PromptingLLM-Assisted Annotation

  16. Ordinary, Reasonable Chatbots: Do AI Models Track Human Legal Judgments?

    Date pendingNirav Patel, Emily Wenger, Christopher BuccafuscoLLM EvaluationDemographic Bias in Language Models