Large Language Model Bias

Latest papers 233

All topics
CardsList
  1. The Missing Minimal Pair: Stereotype Evaluation in LLMs

    Oct 6, 2026Nataliya Stepanova, Ivan Titov, Emily Allaway +1Large Language Model BiasLarge Language Model Evaluation

  2. Latent space bias directions in LLMs capture confidence, not fairness

    Oct 6, 2026Stephanie Buttigieg, Maeve Madigan, Parameswaran Kamalaruban +1Linear Activation SteeringLarge Language Model Bias

  3. Noise Out, Bias In: Targeted Bias Injection in Diffusion Language Models via Closed-Loop Activation Steering

    Oct 5, 2026Sarim Hashmi, Mukul Ranjan, Abdelrahman Elsayed +3Large Language Model BiasAttacker Large Language Model

  4. Usage-Modulated Sentiment Representations in Large Language Models

    Oct 4, 2026Hongfei Du, Jiacheng Shi, Yanfu Zhang +2SentimentLarge Language Model Bias

  5. Counterfactual Auditing of Bias in Open-Source Large Language Models for Clinical Triage

    Oct 1, 2026Manar Aljohani, Brandon Ho, Kenneth McKinley +2Large Language Model BiasTriage

  6. A Shared Taste for Model-Written Text: The Generator-by-Selector Matrices of "AI-AI Bias" Show No Detectable Own-Model Premium

    Sep 30, 2026Dmitrij ŻatuchinLarge Language Model BiasHuman-Written Text

  7. Population Fidelity: Evaluating Population Representativeness in LLMs

    Sep 28, 2026Neemias B. da Silva, Martin Lukk, Ali Sutani +5Large Language Model BiasDemographics

  8. Narrowing the Horizon: Quantifying Topic Saliency Shifts in Generative Monoculture

    Sep 28, 2026Oriane Peter, Elena Simperl, Kate DevlinLarge Language Model BiasSaliency

  9. Over-Personalization Is a Decision Failure: Generation-Induced Apply Bias in LLMs

    Sep 28, 2026Haeun Jang, Yonghyun Jun, Hwanhee LeeLarge Language Model PersonalizationLarge Language Model Bias

  10. Who Gets a Token, and What Does It Carry? Unequal Name Support and Concept Access in Large Language Models

    Sep 28, 2026Mir Tafseer Nayeem, Davood RafieiLarge Language Model BiasGender

  11. RupeeBias: Auditing Demographic Bias in Indian Economic Guidance from Large Language Models

    Sep 25, 2026Pavithra P M Nair, Bhavik Talaviya, Shourya Bhushan +5Large Language Model BiasBiases

  12. Geopolitical Divisions Across Languages in Large Language Models

    Sep 17, 2026Maxim ChupilkinGeopolitical Grounding InteractsPolitical Discourse

  13. DyMT-ESB: Dynamic Multi-Turn Evaluation of Social Bias in User-LLM Interactions

    Sep 16, 2026Rem Hida, Masahiro Kaneko, Daisuke Oba +2Large Language Model BiasMulti-Turn Interactions

  14. Linguistic Triggers of Gender and Racial Bias in Open-Weight LLMs Applied to Recruitment

    Sep 16, 2026Kosuke Kitahara, Nobuhiro YamaguchiLarge Language Model BiasGender

  15. From a River in Gilead to the Inference Distributions of Large Language Models: Covert Dialect Bias and Linguistic Profiling at Scale

    Sep 16, 2026Chowdhury Mohammad Abdullah, Rita OrjiLarge Language Model BiasDialects

  16. The Role of Implicit and Explicit Demographic Signals in Large Language Model-based Student Assessment

    Sep 15, 2026Donya Rooein, Luca Benedetto, Dirk HovyLarge Language Model BiasComputerized Adaptive Testing

  17. FairLint-DL: An IDE-Native Tool for Fairness Debugging of Deep Learning Software

    Sep 14, 2026Archit Rathod, Saeid Tizpaz-NiariAlgorithmic FairnessLarge Language Model Bias

  18. EduFair-Bench: Evaluating Pedagogical Fairness of LLM Tutors Across Student Demographics

    Sep 14, 2026Jiaxu Zhao, Bahar Radmehr, Fares Fawzi +2TutorsLarge Language Model Bias

  19. When Noise Fabricates Bias: The Fragility of LLM-as-a-Judge Bias Measurement under Noisy Text

    Sep 10, 2026DongHyun Ryu, Jaehyeok Lee, YeongJun Hwang +1Large Language Model BiasLlm-As-A-Judge

  20. Reference-Based Bias Detection in LLMs via Relative Representations of Hidden States

    Sep 9, 2026Marek Jeliński, Jan Dubiński, Maciej Chrabaszcz +1Large Language Model BiasModel Auditing

  21. Deep and shallow biases in language models

    Sep 9, 2026An Vo, Vy Tuong Dang, Khai-Nguyen Nguyen +4Large Language Model BiasBiases

  22. The Audit Decides the Verdict: Instrument Effects Rival Demographic Bias in LLM Decision Audits

    Sep 8, 2026Siddharth Vohra, Manikandan RavikiranLarge Language Model BiasModel Auditing

  23. Navigating the digital spectrum: Assessing political bias, stability, and downstream fairness in Large Language Models

    Sep 8, 2026Luka Debevc, Nishan Chatterjee, Antoine Doucet +2Large Language Model BiasHate Speech Detection

  24. From Echo Chambers to Epistemic Monoculture: Large Language Models Present Temporally Contingent Partisan Alignments as Knowledge

    Sep 7, 2026Wend K. TamPolitical DiscourseLarge Language Model Alignment

  25. Aligned but Flattened: Analyzing the Trade-off between Cultural Alignment and Diversity in LLMs

    Sep 1, 2026Jingshen Zhang, Shaoyang Xu, Wenxuan ZhangLarge Language Model AlignmentCultural Awareness

  26. Authority Bias in Conversational Search Engines for Academic Paper Recommendation

    Aug 31, 2026Uthman Jinadu, Parsa Ghazvinian, Anjila Budathoki +3Large Language Model BiasLarge Language Model Decisions

  27. LLM-as-a-Demographic: Whom Sociodemographic Prompting Helps, and Whom It Hurts

    Aug 31, 2026Daniela Occhipinti, Andrea Piergentili, Marco GueriniDemographicsLarge Language Model Bias

  28. Evaluating and Mitigating Anti-LGBTQ Biases in German and Multilingual Language Models

    Aug 31, 2026Melina Morch, Daniel BraunLarge Language Model BiasMultilingual Benchmark

  29. Pak3H: Evaluating the Cost of Cultural Mismatch in LLM Alignment with a Human-Contextualized Urdu Benchmark

    Aug 30, 2026Abdullah Hashmat, Usman Naseem, Agha Ali RazaUrduLarge Language Model Alignment

  30. Definitional Sensitivity in Media Bias Detection: A Multi-Definition Dataset and Benchmark

    Aug 24, 2026Martin Wessel, Timo Spinde, Jürgen Pfeffer +1Large Language Model BiasTask Framing

  31. Every Token Counts: Exact Likert-Scale Distributions for Measuring LLM Attitudes and Biases

    Aug 11, 2026Davood Wadi, Mohsen Ghodrat, Matthew PhilpLarge Language Model BiasLarge Language Model Evaluation

  32. Subjective Multi-Bias Detection with Large Language Models

    Aug 10, 2026Ruiyu Li, Zhiying ZhuLarge Language Model BiasText Corpora

  33. Same Question, Different Answer? Measuring and Mitigating Prompt Privilege for Equitable AI Access

    Aug 9, 2026Lier Jin, Lan Hu, Binqi Shen +2Prompt EngineeringLarge Language Model Bias

  34. Fair on the Surface? Benchmarking Hidden-Output Fairness Gaps in LLM Recommenders

    Aug 8, 2026Chan Aristella Lu, Arya Fayyazi, Junhao Zhang +6Fairness AuditsLarge Language Model Bias

  35. People Are Not Just Their Countries. Disentangling Social Determinants of LLM Value Alignment Across Europe

    Aug 7, 2026Maria-Louisa Wightman, Guillaume Bied, Tijl De BieHuman ValuesLarge Language Model Alignment

  36. Confirming Our Biases? Evaluating the Capabilities, Risks, and Societal Impact of Large Language Models

    Aug 7, 2026Mudar Adas, Polina Tsvilodub, Michael Franke +1Large Language Model BiasTask Framing

  37. Poli-Bias: Understanding and Measuring Large Language Model Biases in International Political Conflicts

    Aug 6, 2026Massi-Nissa Abboud, Aladin Djuhera, Elena Cabrio +1Large Language Model BiasGeopolitical Grounding Interacts

  38. Mitigating Scoring Bias in LLM-as-a-Judge via Random Number Generation

    Aug 6, 2026Yuma Asato, Kiyoaki Shirai, Natthawut KertkeidkachornLarge Language Model BiasLlm-As-A-Judge

  39. Measuring and Detecting Harmful AI Sycophancy

    Aug 6, 2026Bohan Jiang, Dawei Li, Yasin Silva +1SycophancyLarge Language Model Bias

  40. Language Models Generalize to Human-like Word Order Preferences

    Aug 5, 2026Amanda Popadich, Shane Steinert-ThrelkeldLanguage ModelingLarge Language Model Bias

  41. The Fairness Collapse Phenomenon: Bias Amplification in Language Models Trained on Synthetic Data

    Aug 4, 2026Irina Proskurina, Antoine Gourru, Julien VelcinLarge Language Model BiasSynthetic Data

  42. Human-LLM Alignment in Language Attitudes Toward Non-Native Japanese

    Aug 3, 2026Naho Orita, Hayato Ogawa, Daisuke KawaharaLarge Language Model BiasLanguage Pairs

  43. A Heuristic Perspective on Debiasing Language Models

    Aug 1, 2026Tian Lan, Yemin Wang, Chuancheng Shi +6Large Language Model BiasDebiasing

  44. The persuasive power of large language models does not depend on their perceived national origin

    Jul 31, 2026Ningzhi Liu, Yannic Hinrichs, Jonas R. KunstPersuasionSocial Influence

  45. AI systems and the reproduction of (standard) language ideologies in World Englishes

    Jul 30, 2026Kingsley UgwuanyiLanguage PairsLarge Language Model Bias

  46. Fairness Pruning: Locating Demographic Bias in GLU-MLP Layers via Differential Activations

    Jul 30, 2026Pere Martra, Eugenio Martínez Cámara, Alfonso Ureña LópezLarge Language Model BiasModel Activations

  47. From Minds to Models: The Intersection of Psychology and LLM Behaviours

    Jul 30, 2026Oliver Guidetti, Reza RyanLarge Language Model BiasPsychology