Language Model Bias Evaluation

Latest papers 321

All topics
CardsList
  1. Prompt Robustness Is Task-Dependent: Comparing Objective and Belief-Style Questions in LLM Evaluation

    Jul 6, 2026Sadia Kamal, Arefa Patwary, Anthony Marchiafava +2LLM EvaluationLanguage Model Generation Evaluation

  2. Ask the Right Comparison:Bias-Aware Bayesian Active Top-kk Ranking with LLM Judges

    Jul 2, 2026Jian Xu, Delu Zeng, John Paisley +1Pairwise ComparisonLLM-as-a-Judge

  3. Distill to Detect: Exposing Stealth Biases in LLMs through Cartridge Distillation

    Jul 1, 2026Shayan Talaei, Abhinav Chinta, Devvrit Khatri +3LLM AuditingLanguage Model Distillation

  4. Evaluating Large Language Model Raters for German Open-Response Clinical Questions: A Physician-Annotated Benchmark Study of Agreement, Evaluator Bias, and Abstention

    Jul 1, 2026William Philipp, Finn Fassbender, Daniel Fister +12Multilingual Language Model EvaluationLLM-as-a-Judge

  5. Moral Safety in LLMs: Exposing Performative Compliance with Puzzled Cues

    Jun 30, 2026Mohammadamin Shafiei, Shuyue Stella Li, Yulia TsvetkovLanguage Model Safety EvaluationLanguage Model Bias Evaluation

  6. Estimating Grammatical Gender Directions in Contextual Embeddings under Controlled and Natural Contexts

    Jun 29, 2026Huanping Xiao, Yingji LiGender Bias in Language ModelsRepresentation Disentanglement

  7. Can LLMs Hire Fairly? Racial Bias in Resume Screening

    Jun 27, 2026Zhenyu Gao, Wenxi Jiang, Yutong YanGender Bias in Language ModelsSocial Bias in Language Models

  8. To Compare, or Not to Compare: On Methodological Practices in Evaluating Social Bias

    Jun 23, 2026Federico Marcuzzi, Xuefei Ning, Roy Schwartz +1Pairwise ComparisonLLM Auditing

  9. UnBias-Plus: Detect, Explain, and Rewrite Bias

    Jun 22, 2026Ahmed Y. Radwan, Ahmed ElKady, Sindhuja Chaduvula +3Explainable Artificial IntelligenceSocial Bias in Language Models

  10. Same question, different history: language, national identity, and credit in large language models

    Jun 22, 2026William Guey, Pierrick Bougault, Wei Zhang +2Social Bias in Language ModelsCultural Bias in Language Models

  11. Language-Specific Sentiment Polarity Biases in Encoder and Large Language Model Classification of Product Reviews

    Jun 22, 2026Advita Rajiv, Kavitha Kothur, Gautham ReddyMultilingual Language Model EvaluationLLM Evaluation

  12. Self-Preference Is Weak or Absent in Verifiable Instruction-Following Revision: A Four-Model Test Under Genuine Authorship

    Jun 18, 2026William Guey, Pierrick BougaultLLM Self-CorrectionLanguage Model Bias Evaluation

  13. Reliability without Validity: A Systematic, Large-Scale Evaluation of LLM-as-a-Judge Models Across Agreement, Consistency, and Bias

    Jun 17, 2026Justin D. Norman, Michael U. Rivera, D. Alex HughesInter-Rater ReliabilityLLM Evaluation

  14. MortarBench: Evaluating Mortgage Loan Origination Agents

    Jun 17, 2026Matthew Toles, Yunan Lu, Manav Munjal +6Financial ServicesLanguage Model Calibration

  15. Quantifying and Auditing LLM Evaluation via Positive--Unlabeled Learning

    Jun 17, 2026Zilong Zhang, Yi-Ting Hung, Lei Ding +1Inverse Optimal TransportLLM-as-a-Judge

  16. The Wrong Kind of Right: Quantifying and Localizing Misfired Alignment in LLMs

    Jun 17, 2026Naihao Deng, Yiming Feng, Chimaobi Okite +4LLM GroundingLLM Alignment

  17. Gender Bias in LLM Hiring Decisions: Evidence from a Japanese Context and Evaluation of Mitigation Strategies

    Jun 17, 2026Serena A. Hoffstedde, Machiko Hirota, Akshara Nadayanur Sathis Kanna +4Gender Bias in Language ModelsAI-Assisted Decision Making

  18. LLMs Infer Cultural Context but Fail to Apply It When Responding

    Jun 16, 2026Yisong Miao, Jian Zhu, Vered ShwartzPragmatic Reasoning in Language ModelsCultural Bias in Language Models

  19. Evaluating Second-Order Bias of LLMs Through Epistemic Entitlement

    Jun 16, 2026Ramaravind Kommiya Mothilal, Terry Jingchen Zhang, Raiyan Ahmed +3LLM-as-a-JudgeSocial Bias in Language Models

  20. Thinking Like a Scientist? A Structural Study of LLM-Generated Research Methods

    Jun 15, 2026Francesca Carlon, Brecht Verbeken, Vincent Ginis +1LLM EvaluationAI-Assisted Scientific Research

  21. MIRAGE: Auditing Anti-Muslim Bias in Frontier LLMs Across Reasoning, Agentic, and Time-Coupled Conditions

    Jun 15, 2026Noor Islam S. Mohammad, Tamim SheikhLLM Safety BenchmarksLLM Auditing