Stereotype Mitigation

Momentum

9 papers in the last four weeks, up 200% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 42

All topics
CardsList
  1. Acmite: Mitigating Gender Bias in LLMs through Concept-Guided Mutual Information

    Oct 1, 2026Tian Lan, Xiaoqing Cheng, Han Zhang +1Gender BiasStereotype Mitigation

  2. Gender bias across LLMs is common and highly heterogeneous

    Sep 29, 2026Edoardo Bolzoni, Valerio CapraroGender BiasStereotype Mitigation

  3. Deconstructing Stereotypes: Scope-Conditioned Generation for Effective Multilingual Counterspeech

    Sep 15, 2026Greta Damo, Elias Urios Alacreu, Elena Cabrio +2Stereotype MitigationHate Speech

  4. Prompt Revision as a Source of Cultural Bias in Text-to-Image Systems

    Sep 12, 2026Aleksandra Urman, Elsa Lichtenegger, Salima Jaoua +7Stereotype MitigationText Generation

  5. When Noise Fabricates Bias: The Fragility of LLM-as-a-Judge Bias Measurement under Noisy Text

    Sep 10, 2026DongHyun Ryu, Jaehyeok Lee, YeongJun Hwang +1Large Language Model BiasLlm-As-A-Judge

  6. Voice or Stereotype? Disentangling Acoustic and Content-Based Gender in Speech-to-Speech Models

    Sep 10, 2026Xiaoqun Liu, Tanu Mitra, Harshit Rajgarhia +1GenderSeed-Tts-Eval Benchmark

  7. Tracing Stereotypes from Representation to Output in Multilingual LLMs

    Sep 8, 2026Ariun-Erdene Tumurchuluun, Yusser Al Ghussin, Pinzhen Chen +2Stereotype MitigationCross-Lingual Transfer

  8. Right Frame, Wrong Rule: Cultural Cues Expose the Financial Knowledge Gap They Were Meant to Close

    Sep 1, 2026Rania Elbadry, Ahmed Heakl, Saeed Almheiri +12Social NormsInterpretive Layer

  9. Evaluating and Mitigating Anti-LGBTQ Biases in German and Multilingual Language Models

    Aug 31, 2026Melina Morch, Daniel BraunLarge Language Model BiasMultilingual Benchmark

  10. ContextBias: Controlled Evaluation of Bias Persistence Under Context Shift in Text-to-Image Models

    Aug 30, 2026Shaghayegh Kolli, Sina Emami, Moreno D'Incà +4Modern Text-To-Image ModelsStereotype Mitigation

  11. STEREODISCO: Discovering Stereotypicality in LLMs

    Jul 30, 2026Farane Jalali Farahani, Corina Dima, Mojtaba Nayyeri +2Stereotype MitigationLarge Language Model Annotations

  12. Evaluating Regional Bias in LLMs From Abstract Stereotype to Concrete Social Decision-Making

    Jul 29, 2026Jiayuan Di, Haoyi Yang, Yufei Luo +2Stereotype MitigationGeometric Bias

  13. Probing Latent Colombian Identity Inferences in Qwen2.5-7B with Natural Language Autoencoders

    Jul 23, 2026Pablo Santiago Potes Velasco, María del Mar García Matabanchoy, Óscar Julián Pérez Ladino +3Stereotype MitigationInterpretability

  14. When Debiasing Backfires: Counterintuitive Side Effects of Preprocessing-Based Stereotype Mitigation

    Jul 8, 2026Yahan Zheng, John Guerrerio, Soroush Vosoughi +1Stereotype MitigationPreprocessing

  15. Scalable and Culturally Specific Stereotype Dataset Construction via Human-LLM Collaboration

    Jul 8, 2026Weicheng Ma, John Guerrerio, Soroush VosoughiStereotype MitigationMultilingual Benchmark

  16. Training-Free Debiasing of Diffusion Models via CLIP-Guided Denoising Optimization

    Jul 1, 2026Dain Kim, Jinseo Kim, Sungyong BaikText-To-Image Diffusion ModelsDiffusion Models

  17. Unmasking LAION-5B: Age, Gender, Race, and Emotion Biases in Large-Scale Image Datasets

    Jun 22, 2026Iris Dominguez-Catena, Daniel Paternain, Mikel GalarDemographicsLarge-Scale Image Datasets

  18. The Wrong Kind of Right: Quantifying and Localizing Misfired Alignment in LLMs

    Jun 17, 2026Naihao Deng, Yiming Feng, Chimaobi Okite +4Large Language Model AlignmentMisalignment Persona

  19. AmchiBias: Measuring Stereotypical Bias in Goan Identity Groups with a Minimal Pair Dataset in English and Konkani

    Jun 13, 2026Michelle Barbosa, Sebastian Padó, Franziska WeeberStereotype MitigationLanguage Modeling

  20. Characterizing Cultural Localization in AI-Generated Stories

    Jun 12, 2026Shaily Bhatt, Supriti Vijay, Jeremiah Milbauer +1Narrative GenerationNarratives

  21. It Takes One to Bias Them All: Breaking Bad with One-Shot GRPO

    Jun 9, 2026Naihao Deng, Yilun Zhu, Naichen Shi +2Large Language Model BiasLarge Language Model Alignment

  22. Neutrality Bites: Gender Representation in AI-Generated Animal Stories

    Jun 6, 2026Imani Finkley, Yuanxi Li, Melanie WalshGender BiasGender

  23. Identifying High-Confidence Social Biases in LLMs for Trustworthy Conversational Tutoring Agents

    Jun 1, 2026Aitor Arronte Alvarez, Naiyi Xie FinchamLarge Language Model BiasTutors

  24. Anchoring LLM Gender Bias to Human Baselines: A Cross-Lingual Audit

    May 29, 2026Jiwoo Choi, Seonwoo Ahn, Tongxin Zhang +1Large Language Model BiasStereotype Mitigation

  25. GRUFF: LLM Pronoun Fidelity, Reasoning, and Biases in German

    May 28, 2026Fabian Mewes, Anne Lauscher, Vagrant GautamLarge Language Model BiasGender

  26. Side-by-side Comparison Amplifies Dialect Bias in Language Models

    May 23, 2026Kritee Kondapally, Claire J. Smerdon, Pooja C. Patel +5Large Language Model BiasDialects

  27. Assisted Counterspeech Writing at the Crossroads of Hate Speech and Misinformation

    May 21, 2026Genoveffa Martone, Helena Bonaldi, Marco GueriniHate SpeechMisinformation

  28. StereoTales: A Multilingual Framework for Open-Ended Stereotype Discovery in LLMs

    May 11, 2026Pierre Le Jeune, Étienne Duchesne, Weixuan Xiao +4Stereotype MitigationBiases

  29. Progressing beyond Art Masterpieces or Touristic Clichés: how to assess your LLMs for cultural alignment?

    Apr 28, 2026António Branco, João Silva, Nuno Marques +10Cultural AwarenessLarge Language Model Alignment

  30. Intersectional Fairness in Large Language Models

    Apr 22, 2026Chaima Boufaied, Ronnie De Souza Santos, Ann BarcombLarge Language Model BiasStereotype Mitigation

  31. Cross-Cultural Value Attribution in Large Vision-Language Models

    Apr 10, 2026Phillip Howard, Xin Su, Kathleen C. FraserStereotype MitigationMoral Reasoning

  32. Evaluating Implicit Biases in LLM Reasoning through Logic Grid Puzzles

    Nov 8, 2025Fatima Jahara, Mark Dredze, Sharon LevyLarge Language Model BiasLLM Reasoning Strategies

  33. Fair-GPTQ: Bias-Aware Quantization for Large Language Models

    Sep 18, 2025Irina Proskurina, Guillaume Metzler, Julien VelcinLarge Language Model QuantizationAlgorithmic Fairness

  34. BiasGym: A Simple and Generalizable Framework for Analyzing and Removing Biases through Injection

    Aug 12, 2025Sekh Mainul Islam, Nadav Borenstein, Siddhesh Milind Pawar +3Large Language Model BiasBiases

  35. AI's Blind Spots: Geographic Knowledge and Diversity Deficit in Generated Urban Scenario

    Jun 20, 2025Ciro Beneduce, Massimiliano Luca, Bruno LepriText-To-Image Diffusion ModelsDiffusion Models

  36. When majority rules, minority loses: bias amplification of gradient descent

    May 19, 2025François Bachoc, Jérôme Bolte, Ryan Boustany +1MinorityImbalanced Classification

  37. General Phrase Debiaser: Debiasing Masked Language Models at a Multi-Token Level

    Nov 23, 2023Bingkang Shi, Xiaodan Zhang, Dehan Kong +4DebiasingLarge Language Model Bias