Demographic Bias in Language Models

Latest papers 80

All topics
CardsList
  1. Probing Latent Colombian Identity Inferences in Qwen2.5-7B with Natural Language Autoencoders

    Jul 23, 2026Pablo Santiago Potes Velasco, María del Mar García Matabanchoy, Óscar Julián Pérez Ladino +3LLM InterpretabilityCultural Bias in Language Models

  2. Sympathetic Framing: Evaluating AI Alignment across Sociodemographic Groups

    Jul 22, 2026Haran Shani-Narkiss, Michael Fire, Oren TsurLLM EvaluationLLM Alignment

  3. Moral Safety in LLMs: Exposing Performative Compliance with Puzzled Cues

    Jun 30, 2026Mohammadamin Shafiei, Shuyue Stella Li, Yulia TsvetkovLanguage Model Safety EvaluationLanguage Model Bias Evaluation

  4. Demographic Metadata as Construct-Irrelevant Noise in DistilBERT-Based Automated Essay Scoring

    Jun 19, 2026Teik Peng Ch'ng, Hui Na ChuaAutomated Essay ScoringDemographic Bias in Language Models

  5. StylisticBias: A Few Human Visual Cues Drive Most Social Biases in MLLMs

    Jun 18, 2026Shaghayegh Kolli, Timo Cavelius, Nafiseh Nikeghbal +2Social Bias in Language ModelsMultimodal Large Language Models

  6. AgentFairBench: Do LLM Agents Discriminate When They Act?

    Jun 15, 2026Triveni Morla, Rohith Reddy Bellibaltu, Manpreet Singh +1Algorithmic FairnessLLM Agent Evaluation

  7. A Computational Audit of Demographic Association Encoding in ClinicalBERT Language Predictions

    Jun 12, 2026Kehinde Temitayo SoetanLanguage Model Bias EvaluationDemographic Bias in Language Models

  8. Beyond Third-Person Audits: Situated Interaction Auditing for User-Centered LLM Bias Research

    Jun 10, 2026Andrés Abeliuk, Cinthia Sanchez Macias, Valentina Alarcón +2Gender Bias in Language ModelsSocial Bias in Language Models

  9. Debiasing Without Protected Attributes: Latent Concept Erasure from Textual Profiles

    Jun 10, 2026Shun Shao, Zheng Zhao, Anna Korhonen +2Debiased MLAlgorithmic Fairness

  10. Pareto-Guided Teacher Alignment for Fair Personalized Text Generation

    Jun 8, 2026Tunazzina IslamLanguage Model Bias EvaluationMulti-Objective Language Model Alignment

  11. The Geography of Algorithmic Judgment: LLM Intermediaries, Place Identity, and Racial Steering in Housing Search

    Jun 4, 2026Hana Samad, Trung Lam, Christoph Mügge-Durum +1LLM AuditingSocial Bias in Language Models

  12. From Self to Other: Evaluating Demographic Perspective-Taking in LLM Hate Speech Annotation

    Jun 4, 2026Paloma Piot, Javier ParaparLLM-Assisted AnnotationHate Speech Detection

  13. Epistemic Injustice in Language Models: An Audit of Pretraining Filters and Guardrails

    Jun 4, 2026Marco Antonio Stranisci, A Pranav, Rossana Damiano +2LLM GuardrailsTraining Data Curation

  14. Large Language Models in K-12 Education: Alignment with State Curriculum Standards and Student Personas

    Jun 3, 2026Lisa Korver, Tomo Lazovich, Sherief RedaLLM EvaluationAI in Education

  15. The Ghost Annotator: a Framework to Explore Human Label Variation in Content Moderation through Conformal Prediction

    Jun 1, 2026Mirko Lai, Alessandra Urbinati, Simona Frenda +2Annotator DisagreementConformal Prediction

  16. Topics as Proxies for Sociodemographics: How Conversational Context Affects LLM Answers

    Jun 1, 2026Vera Neplenbroek, Gabriele Sarti, Arianna Bisazza +1Social Bias in Language ModelsLanguage Modeling

  17. Persona Prompting in Multimodal Urban Perception: Descriptive Convergence and Interpretive Variation

    May 27, 2026Neemias da Silva, Matt Ratto, Myriam Delgado +3Multimodal Large Language ModelsLanguage Model Bias Evaluation

  18. Whose Name Comes Up? III: Persona Prompting Effects in LLM-Based Scholar Recommendation

    May 27, 2026Annabella Sánchez-Guzmán, Lukas Eberhard, Denis Helic +1LLM AuditingLLM Prompting

  19. Insidious by Design: Implications of Large Language Model algorithmic bias for the Global South

    May 26, 2026Sioux McKenna, Nompilo TshumaGender Bias in Language ModelsCultural Bias in Language Models

  20. When Symptoms Are Not Enough: Evidence-Weighting Patterns in Large Language Model Psychiatric Screening

    May 22, 2026Jianfeng Zhu, Megan Korhummel, Ruoming Jin +1Medical DiagnosisMental Health

  21. When Do LLMs Generate Realistic Social Networks? A Multi-Dimensional Study of Culture, Language, Scale, and Method

    May 13, 2026Sai Hemanth Kilaru, Sriram Theerdh Manikyala, Raghav Upadhyay +3LLM PromptingSocial Bias in Language Models

  22. The Refusal--Compliance Tradeoff: A Large-Scale Safety Behavior Audit of Large Language Models

    May 6, 2026Alif Al Hasan, Sumon BiswasLLM Safety BenchmarksLanguage Model Safety Evaluation

  23. Measuring and Mitigating Bias in Code Generated by Large Language Models

    May 5, 2026Yuxi Chen, Yutian Tang, Timothy StorerAlgorithmic BiasLanguage Model Bias Evaluation

  24. Auditing demographic bias in AI-based emergency police dispatch: a cross-lingual evaluation of eleven large language models

    May 2, 2026William Guey, Wei Zhang, Pierrick Bougault +4Multilingual Language Model EvaluationLLM Auditing

  25. Mapping how LLMs debate societal issues when shadowing human personality traits, sociodemographics and social media behavior

    Apr 30, 2026Ali Aghazadeh Ardebili, Massimo StellaSocial Bias in Language ModelsLanguage Model Bias Evaluation