Pluralistic Alignment

Momentum

1 paper in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 27

All topics
CardsList
  1. Which Objectives Need a Dial? Predicting Objective Conflict and Covering Trade-offs in Steerable Pluralistic Alignment

    Sep 22, 2026David Tsoi, Esra DönmezPluralistic AlignmentTrade-Off

  2. OntoAligner-Ensemble: Voting-Based Fusion across Heterogeneous Ontology Alignment Techniques

    Aug 31, 2026Hamed Babaei Giglou, Sören Auer, Peio Popov +2EnsemblePluralistic Alignment

  3. Group Alignment-Induced Sycophancy: A Two-Sided Evaluation of Steerable Pluralistic Alignment

    Aug 12, 2026Haokai Zhao, Yunze Xiao, Weihao Xuan +3SycophancyPluralistic Alignment

  4. Socially Grounded Agentic AI: Coordinating Plural Perspectives through Social Theory

    Aug 4, 2026Matt Ratto, Abhishek Moturu, Daniel SilverPluralistic AlignmentSocio-Technical Systems

  5. A Roadmap to Impactful Pluralistic Alignment Research

    Jul 24, 2026Elinor Poole-Dayan, Jillian Fisher, Atoosa Kasirzadeh +3Pluralistic AlignmentInternal Pluralism

  6. Rushes: A Human Preference Dataset for Pluralistic Alignment

    Jul 22, 2026Michael Xu, Jorge Leandro, Sudha Rao +5Preference DatasetsPluralistic Alignment

  7. LKValues: Aligning Large Language Models with Sri Lankan Societal Values

    Jul 22, 2026Nethmi Muthugala, Supryadi, Surangika Ranathunga +7Large Language Model AlignmentHuman Values

  8. ToolAlignBench: Investigating Alignment Conflicts in Tool-Calling Enabled LLMs

    Jul 15, 2026Aryan Keluskar, Amrita Bhattacharjee, Huan LiuLarge Language Model SafetyAgentic Deployments

  9. PLURAL: A Global Dataset for Value Alignment

    Jul 9, 2026Dhruv Agarwal, Anya Shukla, Tanya Goyal +1Preference DatasetsPluralistic Alignment

  10. Position: Align AI to Our Aspirations, Not Our Flaws

    Jun 11, 2026Nikita Kazeev, Bui Nhat Huyen PhanPluralistic AlignmentInternal Pluralism

  11. Quantifying the Salience of Geo-Cultural Values for Pluralistic Safety Alignment

    May 29, 2026Arkadiy Saakyan, Charvi Rastogi, Lora AroyoCultural AwarenessMultilingual Safety

  12. AvAtar: Learning to Align via Active Optimal Transport

    May 23, 2026Qi Yu, Ruizhong Qiu, Zhichen Zeng +3Distributional AlignmentPluralistic Alignment

  13. From Sycophantic Consensus to Pluralistic Repair: Why AI Alignment Must Surface Disagreement

    May 14, 2026Varad Vishwarupe, Nigel Shadbolt, Marina JirotkaPluralistic AlignmentInternal Pluralism

  14. DVMap: Fine-Grained Pluralistic Value Alignment via High-Consensus Demographic-Value Mapping

    May 14, 2026Pengyun Zhu, Yuqi Ren, Zhen Wang +2Pluralistic AlignmentLarge Language Model Alignment

  15. When Helpfulness Becomes Sycophancy: Sycophancy is a Boundary Failure Between Social Alignment and Epistemic Integrity in Large Language Models

    May 6, 2026Jiechen Li, Catherine A. Barry, Rishika Randev +3SycophancyEpistemic Integrity

  16. Misaligned by Reward: Socially Undesirable Preferences in LLMs

    May 6, 2026Gayane Ghazaryan, Esra DönmezLarge Language Model AlignmentLarge Language Model Bias

  17. Adaptive Pluralistic Alignment: A pipeline for dynamic artificial democracy

    May 2, 2026Rachel FreedmanPluralistic AlignmentLock-In

  18. Jailbreaking Large Language Models with Morality Attacks

    Apr 18, 2026Ying Su, Mingen Zheng, Weili Diao +1Large Language Model JailbreaksMoral Reasoning

  19. VoxSafeBench: Not Just What Is Said, but Who, How, and Where

    Apr 16, 2026Yuxiang Wang, Hongyu Liu, Yijiang Xu +9Speech Language ModelsPluralistic Alignment

  20. VISPA: Pluralistic Alignment via Automatic Value Selection and Activation

    Jan 19, 2026Shenyan Zheng, Jiayou Zhong, Anudeex Shetty +3Pluralistic AlignmentLarge Language Model Alignment

  21. MiCRo: Mixture Modeling and Context-aware Routing for Personalized Preference Learning

    May 30, 2025Jingyan Shen, Jiarui Yao, Rui Yang +5Large Language Model PersonalizationPreference Alignment Learning

  22. Societal Alignment Frameworks Can Improve LLM Alignment

    Feb 27, 2025Karolina Stańczak, Nicholas Meade, Mehar Bhatia +14Large Language Model AlignmentPluralistic Alignment

  23. SaFeR-Steer: Evolving Multi-Turn MLLMs via Synthetic Bootstrapping and Feedback Dynamics

    Date pendingHaolong Hu, Hanyu Li, Tiancheng He +6Mllm-BasedLarge Language Model Alignment