Language Model Bias Evaluation

Latest papers 321

All topics
CardsList
  1. QuantiBias: Benchmarking Quantization-Induced Bias in LLMs

    Jul 23, 2026Emilio FerraraOpen-Ended GenerationLLM Quantization

  2. REGARD: Regional Affective Differences in Large Language Models

    Jul 22, 2026Andrei Chetvergov, Alexander Evseev, Mikhail Solovev +5Political Bias in Language ModelsValence-Arousal Modeling

  3. Evaluating and Mitigating Gender Bias in Pre-trained Embeddings for ML-based Recruitment

    Jul 22, 2026Farnaz Faramarzi Lighvan, Lynn HouthuysGender Bias in Language ModelsAlgorithmic Fairness

  4. AutoJourn: Multi-Perspective Summarisation, Bias Detection and Bias Neutralisation for LLM-Generated News in Automated Journalism

    Jul 21, 2026Himel Ghosh, Ahmed Mosharafa, Georg GrohSocial Bias in Language ModelsText Summarization

  5. Innocuous-Seeming Data, Latent Ideology: Ideological Generalisation in Finetuned LLMs

    Jul 16, 2026Robert Graham, Edward Stevinson, Yariv BarsheshatLLM Fine-TuningPolitical Bias in Language Models

  6. The Misclassification of Autistic Writing as AI-Generated

    Jul 16, 2026Summer Chambers, Matthew C. KelleyAI-Generated Text DetectionSocial Bias in Language Models

  7. LLM Evaluators are Biased across Languages

    Jul 16, 2026Ej Zhou, Lucas Resck, Zheng Hui +1Multilingual Language Model EvaluationLanguage Model Safety Evaluation

  8. Value Leakage: An LLM's Answers Are Silently Shaped by Its Own Values

    Jul 15, 2026Jan Betley, Johannes Treutlein, Jan Dubiński +5LLM AlignmentLanguage Model Bias Evaluation

  9. The Test Oracle Problem in Synthetic LLM-as-Judge Corpora: Disappearance, Distortion and a Validation Protocol

    Jul 15, 2026Serkan BallıMultilingual Language Model EvaluationLLM-as-a-Judge

  10. Inside the Unfair Judge: A Mechanistic Interpretability Account of LLM-as-Judge Bias

    Jul 13, 2026Zixiang Xu, Sixian Li, Huaxing Liu +4LLM-as-a-JudgeLLM Interpretability

  11. How Temperature Shapes Ideological Discourse in Retrieval-Augmented Generation?

    Jul 13, 2026Elmira Salari, Hazem Amamou, José Victor de Souza +3Retrieval-Augmented GenerationPolitical Bias in Language Models

  12. Geopolitical alignment: Endorsement effects in large language models

    Jul 10, 2026Maxim ChupilkinPolitical Bias in Language ModelsLanguage Model Bias Evaluation

  13. Do You Need a Frontier Model as a Citation Verifier? Benchmarking Rubric LLMs for Deep-Research Source Attribution

    Jul 9, 2026Ethan Leung, Elias Lumer, Corey Feld +3LLM-as-a-JudgeCitation Verification

  14. When the Judge Changes, So Does the Measurement: Auditing LLM-as-Judge Reliability

    Jul 9, 2026Zongyou Yang, Yinghan Hou, Xiaokun YangLLM-as-a-JudgeLLM Auditing

  15. When Debiasing Backfires: Counterintuitive Side Effects of Preprocessing-Based Stereotype Mitigation

    Jul 8, 2026Yahan Zheng, John Guerrerio, Soroush Vosoughi +1Debiased MLSocial Bias in Language Models

  16. Scalable and Culturally Specific Stereotype Dataset Construction via Human-LLM Collaboration

    Jul 8, 2026Weicheng Ma, John Guerrerio, Soroush VosoughiMultilingual Language Model EvaluationSocial Bias in Language Models

  17. LLMs Silently Correct African American English: Auditing and Mitigating Dialect Bias via Activation Steering

    Jul 7, 2026Huan Wu, Ali Emami, Muhammad Furquan Hassan +5Language Model SteeringSocial Bias in Language Models