Preference Alignment

Latest papers 60

All topics
CardsList
  1. Collaborative Personalized Preference Alignment for LLMs under Data Deficiency

    Oct 5, 2026Liyan Yang, Yige Yuan, Zhiqin YangPreference AlignmentLarge Language Model Personalization

  2. Robust Nash Alignment under Preference Uncertainty

    Sep 30, 2026Shihab Ahmed, Debamita Ghosh, David Tang +3Preference AlignmentNash Equilibrium

  3. A Zeroth-Order Paradigm for LLM Preference Alignment

    Sep 16, 2026Peter Chen, Xi Chen, Wotao Yin +1Preference AlignmentSequential Preference Optimization

  4. FlowCPO: A Unified Divergence View of Preference Alignment for Flow Models

    Sep 9, 2026Yansen Han, Shengyi Liao, Peng Sun +4Flow ModelsPreference Alignment

  5. MoPLEx: Estimating Plackett-Luce Mixture Models for Multi-Objective Alignment

    Aug 25, 2026Dongyue Li, Ziniu Zhang, Lu Wang +1Preference AlignmentMixture Models

  6. Learning Preference Adaptation for Large Language Model Personalization via Verbal Reinforcement Learning

    Aug 10, 2026Yuting Liu, Wei Wu, Jianzhe Zhao +1Large Language Model PersonalizationPreference Alignment

  7. LLM Reasoning for Subjective Tasks: Failure Modes, Mitigation, and Dynamic Reasoning Routing

    Aug 9, 2026Juncheng Dong, Ding Tong, Ishan Gupta +1LLM Reasoning StrategiesSubjectivity

  8. Explore or Converge? Stage-Guided Per-Step Optimization for Diffusion Models

    Aug 7, 2026Renye Yan, Jikang Cheng, You Wu +4Diffusion ModelsPreference Alignment

  9. Compass: Continuously Aligning Social Media Feeds via In-Situ Reflections

    Aug 4, 2026Aadit Barua, Leijie Wang, Amy X. ZhangPreference AlignmentSocial Media

  10. BridgeAlign: Bridging Preference Alignment for Humanities and Social Sciences

    Jul 29, 2026Ru Peng, Haokai Xu, Xijun Gu +11Preference AlignmentComputational Social Science

  11. WearWow: Native 2K Multi-Garment Virtual Try-On via Adaptive Token Packing and Preference Alignment

    Jul 22, 2026Xujie Zhang, Runyan Du, Song Chang +7GarmentsVirtual Try-On

  12. Rewarding Better Thinking for LLM Preference Alignment

    Jul 22, 2026Xubo Liu, Wenya Guo, Ruxue Yan +2Preference AlignmentTrajectory-Level Credit

  13. Toward Anthropomorphic Dialogue: A Closed-Loop Framework for Human-Like Chat Generation, Evaluation, and Preference Alignment

    Jul 19, 2026Wentao Liu, Siyu Song, Xi Chen +4Dialogue BenchmarksArtificial Intelligence Personas

  14. Genre Bias or Aesthetic Perception? Identifying and Mitigating Shortcut Learning in Music Evaluation

    Jul 15, 2026Yizhou Zhang, Wangjin Zhou, Yi Zhao +3AestheticsModel Evaluation

  15. Deployable Human Preference Alignment in Robotics: Learning Representative Rewards from Diverse Human Preferences

    Jul 14, 2026Taehyung Kim, Gwangmo Lee, Minjun Chang +2Preference AlignmentPreference Alignment Learning

  16. Normative Alignment of Recommender Systems via Internal Label Shift

    Jul 12, 2026Johannes Kruse, Kasper Lindskow, Michael Riis Andersen +4Preference AlignmentRecommendation

  17. Beyond Time Shifts: Adapting Omni-LLM as a Reference-Free Evaluator for Generative Audio-Visual Models

    Jul 10, 2026Yijie Qian, Juncheng Wang, Chao Xu +6Audio-Visual ConsistencyCross-Modal

  18. On the Limits of Steering Vectors for Preference-Aligned Generation

    Jul 2, 2026Melanie Subbiah, Zara Hall, Kathleen McKeownPreference AlignmentText Generation

  19. PAPA: Online Personalized Active Preference Alignment

    Jul 1, 2026Anindya Sarkar, Nasik Muhammad Nafi, Isaac Lyngaas +2Preference AlignmentDiffusion Alignment

  20. REAR: Test-time Preference Realignment through Reward Decomposition

    Jun 29, 2026Fuxiang Zhang, Pengcheng Wang, Chenran Li +6Preference AlignmentPreference Alignment Learning

  21. CHILLGuard: Towards Fine-Grained Chinese LLM Safety Guardrail with Scalable Data Construction and Model-aware Preference Alignment

    Jun 13, 2026Wenbo Yu, Bohua Wang, Hao Fang +10Large Language Model SafetyPreference Alignment

  22. Hidden Consensus:Preference-Validity Compression in Human Feedback

    Jun 9, 2026Dorcas Chia Ern Chua, Karen Myn Hui Lee, Jia Yue Tan +9Preference AlignmentReinforcement Learning From Human Feedback

  23. Pareto-Guided Teacher Alignment for Fair Personalized Text Generation

    Jun 8, 2026Tunazzina IslamPersonalizationPreference Alignment

  24. Follow-Your-Preference++: Rethinking Preference Alignment for Image Inpainting

    Jun 2, 2026Junkun Yuan, Yutao Shen, Toru Aonishi +2Preference AlignmentPreference Alignment Learning

  25. TriAlign: Towards Universal Truth Consistency in Personalized LLM Alignment

    Jun 1, 2026Thi-Nhung Nguyen, Linhao Luo, Rollin Omari +3Large Language Model AlignmentPreference Alignment

  26. Pave-GRPO: Beyond Instantaneous Guidance through Principled Average Velocity Decomposition

    Jun 1, 2026Pengyang Ling, Jiazi Bu, Yujie Zhou +6Repair-Based Group-Relative Policy OptimizationGenerative Flow Networks

  27. MENTIS: What Belief Changes Under Alignment? Measuring Multi-Scale Latent Torsion in Language Models

    May 31, 2026Partha Pratim Saha, Samarth Raina, Mayur Parvatikar +4Large Language Model AlignmentPreference Alignment

  28. Differentially Private Preference Data Synthesis for Large Language Model Alignment

    May 29, 2026Fengyu Gao, Jing YangPreference AlignmentLarge Language Model Alignment

  29. When and How Human Curation Backfires: Preference Alignment under Multi-Model Self-Consuming Loop

    May 28, 2026Yang Zhang, Xiukun Wei, Xueru ZhangPreference AlignmentReinforcement Learning From Human Feedback

  30. Toward User Preference Alignment in LLM Recommendation via Explicit Context Feedback

    May 27, 2026Weizhi Zhang, Wooseong Yang, Yuxin Cui +9Preference Alignment LearningPreference Alignment

  31. StoryLens: Preference-Aligned Story Rewriting via Context-Aware Narrative Enrichment

    May 27, 2026Hanwen Cui, Yuting Mei, Yuhang Fu +2RewriteNarrative Generation

  32. Investigating the Interplay between Contextual and Parametric Chain-of-Thought Faithfulness under Optimization

    May 24, 2026Jingyi Sun, Qianli Wang, Pepa Atanasova +2Explanation FaithfulnessFaithfulness

  33. Truthful Online Preference Aggregation for LLM Fine-Tuning in Mobile Crowdsourcing

    May 22, 2026Shugang Hao, Lingjie DuanCrowdsourced FrameworkLarge Language Model Fine-Tuning

  34. Spectral Souping: A Unified Framework for Online Preference Alignment

    May 19, 2026Yinlam Chow, Guy Tennenholtz, Ted Yun +4Preference AlignmentReinforcement Learning From Human Feedback

  35. When Preference Labels Fall Short: Aligning Diffusion Models from Real Data

    May 19, 2026Weiyan Chen, Weijian Deng, Yao Xiao +5Diffusion AlignmentPreference Alignment

  36. Pairwise Preference Reward and Group-Based Diversity Enhancement for Superior Open-Ended Generation

    May 18, 2026Guining Cao, Jiaxin Peng, Chu Zeng +3Preference AlignmentDiversity

  37. Explaining and Breaking the Safety-Helpfulness Ceiling via Preference Dimensional Expansion

    May 12, 2026ShiYing Huang, Liang Lin, Yuer Li +6Preference AlignmentMulti-Objective Reinforcement Learning

  38. ProteinOPD: Towards Effective and Efficient Preference Alignment for Protein Design

    May 11, 2026Yulin Zhang, He Cao, Zihao Jiang +6Protein DesignPreference Alignment

  39. A Single Deep Preference-Conditioned Policy for Learning Pareto Coverage Sets

    May 9, 2026Akihiro Kubo, Kosuke Nakanishi, Shin IshiiMulti-Objective Reinforcement LearningPareto Frontier

  40. Threshold-Guided Optimization for Visual Generative Models

    May 6, 2026Jinbin Bai, Yu Lei, Qingyu Shi +6Preference AlignmentGenerative Models

  41. Towards General Preference Alignment: Diffusion Models at Nash Equilibrium

    May 6, 2026Jiaming Hu, Jiamu Bai, Haoyu Wang +2Diffusion AlignmentPreference Alignment

  42. Online Self-Calibration Against Hallucination in Vision-Language Models

    May 1, 2026Minghui Chen, Chenxu Yang, Hengjie Zhu +3Recent Vision-Language ModelsLarge Language Model Hallucination

  43. Sparse Personalized Text Generation with Multi-Trajectory Reasoning

    Apr 27, 2026Bo Ni, Haowei Fu, Qinwen Ge +10Large Language Model PersonalizationPreference Alignment

  44. HeadRank: Decoding-Free Passage Reranking via Preference-Aligned Attention Heads

    Apr 19, 2026Juyuan Wang, Chenxing Wang, Yuchen Fang +8Cross-Encoder RerankingRelevance

  45. Personalized Group Relative Policy Optimization for Heterogenous Preference Alignment

    Feb 17, 2026Jialu Wang, Heinrich Peters, Asad A. Butt +6Preference AlignmentLarge Language Model Personalization

  46. A Scalable Entity-Based Framework for Auditing Bias in Large Language Models

    Jan 18, 2026Akram Elbouanani, Aboubacar Tuo, Adrian PopescuLarge Language Model BiasFairness Audits

  47. Multi-dimensional Preference Alignment by Conditioning Reward Itself

    Dec 11, 2025Jiho Jang, Jinyoung Kim, Kyungjune Baek +1Diffusion AlignmentBacktranslation Augmented Direct Preference Optimization

  48. Aligning Audio Captions with Human Preferences

    Sep 18, 2025Kartik Hegde, Rehana Mahfuz, Yinyi Guo +1Video CaptioningCaptions

  49. FaST: Feature-aware Sampling and Tuning for Personalized Preference Alignment with Limited Data

    Aug 6, 2025Thibaut Thonet, Germán Kruszewski, Jos Rozen +2Large Language Model PersonalizationPreference Alignment

  50. Adaptive Helpfulness-Harmlessness Alignment with Preference Vectors

    Apr 27, 2025Ren-Wei Liang, Chin-Ting Hsu, Chan-Hung Yu +6Preference AlignmentReinforcement Learning From Human Feedback

  51. TextAlign: Preference Alignment for Text Rendering with Hierarchical Rewards

    Date pendingMingxuan Cui, Jingpu Yang, Fengxian Ji +7Image-Text AlignmentFew-Shot Font Generation

  52. PACIFIC: Can LLMs Discern the Psychometric Traits Influencing Your Preferences? Personality-Driven Preference Alignment in LLMs

    Date pendingTianyu Zhao, Siqi Li, Yasser Shoukry +1Preference AlignmentPreference Alignment Learning