Demographic Bias in Language Models

Latest papers 80

All topics
CardsList
  1. Noise Out, Bias In: Targeted Bias Injection in Diffusion Language Models via Closed-Loop Activation Steering

    Oct 5, 2026Sarim Hashmi, Mukul Ranjan, Abdelrahman Elsayed +3Diffusion Language ModelsDemographic Bias in Language Models

  2. Counterfactual Auditing of Bias in Open-Source Large Language Models for Clinical Triage

    Oct 1, 2026Manar Aljohani, Brandon Ho, Kenneth McKinley +2Clinical Decision-MakingLanguage Model Bias Evaluation

  3. Pruning for Efficiency, Paying in Fairness: Demographic Disparities in Pruned Speech-LLMs

    Sep 29, 2026Ganesh Pavan Kartikeya Bharadwaj Kolluri, Michael Kampouridis, Ravi ShekharLLM PruningAlgorithmic Fairness

  4. Calibrated to Whom? Persona and Language Effects on Cultural Values in JEV

    Sep 28, 2026Bushra Asseri, Abdulaziz AsseriMultilingual Language Model EvaluationCross-Cultural Language Model Evaluation

  5. Population Fidelity: Evaluating Population Representativeness in LLMs

    Sep 28, 2026Neemias B. da Silva, Martin Lukk, Ali Sutani +5LLM EvaluationLLM Fine-Tuning

  6. BA-DPO: Bias-Adjusted Direct Preference Optimization for Language Model Alignment

    Sep 28, 2026Antonio Ferrara, Alberto Rumi, Francesco BonchiLLM AlignmentDebiased ML

  7. RupeeBias: Auditing Demographic Bias in Indian Economic Guidance from Large Language Models

    Sep 25, 2026Pavithra P M Nair, Bhavik Talaviya, Shourya Bhushan +5Language Model Bias EvaluationDemographic Bias in Language Models

  8. Before the Arrest: Benchmarking LLMs on Criminal Profiling from Incomplete Evidence

    Sep 17, 2026Yutong Yao, Yanjie Cao, Guanhua Chen +5Abductive ReasoningLegal Judgment Prediction

  9. Linguistic Triggers of Gender and Racial Bias in Open-Weight LLMs Applied to Recruitment

    Sep 16, 2026Kosuke Kitahara, Nobuhiro YamaguchiGender Bias in Language ModelsAI-Assisted Decision Making

  10. The Role of Implicit and Explicit Demographic Signals in Large Language Model-based Student Assessment

    Sep 15, 2026Donya Rooein, Luca Benedetto, Dirk HovyAI in EducationGenerative AI in Education

  11. EduFair-Bench: Evaluating Pedagogical Fairness of LLM Tutors Across Student Demographics

    Sep 14, 2026Jiaxu Zhao, Bahar Radmehr, Fares Fawzi +2Generative AI in EducationLanguage Model Bias Evaluation

  12. The Audit Decides the Verdict: Instrument Effects Rival Demographic Bias in LLM Decision Audits

    Sep 8, 2026Siddharth Vohra, Manikandan RavikiranLanguage Model Bias EvaluationDemographic Bias in Language Models

  13. From Simulated Citizens to Simulated Deliberation: Challenges in Representation and Interaction

    Sep 7, 2026Chaemin Jang, Junsik Min, Jaewoo Choi +9Opinion DynamicsHuman Behavior Simulation

  14. LLM-as-a-Demographic: Whom Sociodemographic Prompting Helps, and Whom It Hurts

    Aug 31, 2026Daniela Occhipinti, Andrea Piergentili, Marco GueriniLLM-as-a-JudgeLLM Prompting

  15. Mitigating Identity Essentialism in LLM Agents with Longitudinal Life Trajectories

    Aug 20, 2026Hexi Wang, Yujia Zhou, Bangde Du +7Human Behavior SimulationLLM Agent Memory

  16. Locating and Controlling Implicit Personalization in Large Language Models

    Aug 12, 2026Yueru Yan, Siqi Wu, Thai LeLLM PersonalizationLLM Interpretability

  17. Subjective Multi-Bias Detection with Large Language Models

    Aug 10, 2026Ruiyu Li, Zhiying ZhuDemographic Bias in Language Models

  18. Fair on the Surface? Benchmarking Hidden-Output Fairness Gaps in LLM Recommenders

    Aug 8, 2026Chan Aristella Lu, Arya Fayyazi, Junhao Zhang +6LLM AuditingLanguage Model Bias Evaluation

  19. People Are Not Just Their Countries. Disentangling Social Determinants of LLM Value Alignment Across Europe

    Aug 7, 2026Maria-Louisa Wightman, Guillaume Bied, Tijl De BieLLM AlignmentComputational Social Science

  20. Fairness Pruning: Locating Demographic Bias in GLU-MLP Layers via Differential Activations

    Jul 30, 2026Pere Martra, Eugenio Martínez Cámara, Alfonso Ureña LópezLLM PruningLLM Interpretability

  21. When Synthetic Users Fail: A Cross-Domain Benchmark of LLM-Simulated Human Survey Responses

    Jul 28, 2026Zihan Chen, Di Zhu, Lei Nico ZhengLLM EvaluationLarge Language Model-Based Social Simulation

  22. Probing Latent Colombian Identity Inferences in Qwen2.5-7B with Natural Language Autoencoders

    Jul 23, 2026Pablo Santiago Potes Velasco, María del Mar García Matabanchoy, Óscar Julián Pérez Ladino +3LLM InterpretabilityCultural Bias in Language Models

  23. Sympathetic Framing: Evaluating AI Alignment across Sociodemographic Groups

    Jul 22, 2026Haran Shani-Narkiss, Michael Fire, Oren TsurLLM EvaluationLLM Alignment

  24. Moral Safety in LLMs: Exposing Performative Compliance with Puzzled Cues

    Jun 30, 2026Mohammadamin Shafiei, Shuyue Stella Li, Yulia TsvetkovLanguage Model Safety EvaluationLanguage Model Bias Evaluation

  25. Demographic Metadata as Construct-Irrelevant Noise in DistilBERT-Based Automated Essay Scoring

    Jun 19, 2026Teik Peng Ch'ng, Hui Na ChuaAutomated Essay ScoringDemographic Bias in Language Models

  26. StylisticBias: A Few Human Visual Cues Drive Most Social Biases in MLLMs

    Jun 18, 2026Shaghayegh Kolli, Timo Cavelius, Nafiseh Nikeghbal +2Social Bias in Language ModelsMultimodal Large Language Models

  27. AgentFairBench: Do LLM Agents Discriminate When They Act?

    Jun 15, 2026Triveni Morla, Rohith Reddy Bellibaltu, Manpreet Singh +1Algorithmic FairnessLLM Agent Evaluation

  28. A Computational Audit of Demographic Association Encoding in ClinicalBERT Language Predictions

    Jun 12, 2026Kehinde Temitayo SoetanLanguage Model Bias EvaluationDemographic Bias in Language Models

  29. Beyond Third-Person Audits: Situated Interaction Auditing for User-Centered LLM Bias Research

    Jun 10, 2026Andrés Abeliuk, Cinthia Sanchez Macias, Valentina Alarcón +2Gender Bias in Language ModelsSocial Bias in Language Models

  30. Debiasing Without Protected Attributes: Latent Concept Erasure from Textual Profiles

    Jun 10, 2026Shun Shao, Zheng Zhao, Anna Korhonen +2Debiased MLAlgorithmic Fairness

  31. Pareto-Guided Teacher Alignment for Fair Personalized Text Generation

    Jun 8, 2026Tunazzina IslamLanguage Model Bias EvaluationMulti-Objective Language Model Alignment

  32. The Geography of Algorithmic Judgment: LLM Intermediaries, Place Identity, and Racial Steering in Housing Search

    Jun 4, 2026Hana Samad, Trung Lam, Christoph Mügge-Durum +1LLM AuditingSocial Bias in Language Models

  33. From Self to Other: Evaluating Demographic Perspective-Taking in LLM Hate Speech Annotation

    Jun 4, 2026Paloma Piot, Javier ParaparLLM-Assisted AnnotationHate Speech Detection

  34. Epistemic Injustice in Language Models: An Audit of Pretraining Filters and Guardrails

    Jun 4, 2026Marco Antonio Stranisci, A Pranav, Rossana Damiano +2LLM GuardrailsTraining Data Curation

  35. Large Language Models in K-12 Education: Alignment with State Curriculum Standards and Student Personas

    Jun 3, 2026Lisa Korver, Tomo Lazovich, Sherief RedaLLM EvaluationAI in Education

  36. The Ghost Annotator: a Framework to Explore Human Label Variation in Content Moderation through Conformal Prediction

    Jun 1, 2026Mirko Lai, Alessandra Urbinati, Simona Frenda +2Annotator DisagreementConformal Prediction

  37. Topics as Proxies for Sociodemographics: How Conversational Context Affects LLM Answers

    Jun 1, 2026Vera Neplenbroek, Gabriele Sarti, Arianna Bisazza +1Social Bias in Language ModelsLanguage Modeling

  38. Persona Prompting in Multimodal Urban Perception: Descriptive Convergence and Interpretive Variation

    May 27, 2026Neemias da Silva, Matt Ratto, Myriam Delgado +3Multimodal Large Language ModelsLanguage Model Bias Evaluation

  39. Whose Name Comes Up? III: Persona Prompting Effects in LLM-Based Scholar Recommendation

    May 27, 2026Annabella Sánchez-Guzmán, Lukas Eberhard, Denis Helic +1LLM AuditingLLM Prompting

  40. Insidious by Design: Implications of Large Language Model algorithmic bias for the Global South

    May 26, 2026Sioux McKenna, Nompilo TshumaGender Bias in Language ModelsCultural Bias in Language Models

  41. When Symptoms Are Not Enough: Evidence-Weighting Patterns in Large Language Model Psychiatric Screening

    May 22, 2026Jianfeng Zhu, Megan Korhummel, Ruoming Jin +1Medical DiagnosisMental Health

  42. When Do LLMs Generate Realistic Social Networks? A Multi-Dimensional Study of Culture, Language, Scale, and Method

    May 13, 2026Sai Hemanth Kilaru, Sriram Theerdh Manikyala, Raghav Upadhyay +3LLM PromptingSocial Bias in Language Models

  43. The Refusal--Compliance Tradeoff: A Large-Scale Safety Behavior Audit of Large Language Models

    May 6, 2026Alif Al Hasan, Sumon BiswasLLM Safety BenchmarksLanguage Model Safety Evaluation

  44. Measuring and Mitigating Bias in Code Generated by Large Language Models

    May 5, 2026Yuxi Chen, Yutian Tang, Timothy StorerAlgorithmic BiasLanguage Model Bias Evaluation

  45. Auditing demographic bias in AI-based emergency police dispatch: a cross-lingual evaluation of eleven large language models

    May 2, 2026William Guey, Wei Zhang, Pierrick Bougault +4Multilingual Language Model EvaluationLLM Auditing

  46. Mapping how LLMs debate societal issues when shadowing human personality traits, sociodemographics and social media behavior

    Apr 30, 2026Ali Aghazadeh Ardebili, Massimo StellaSocial Bias in Language ModelsLanguage Model Bias Evaluation