Preference Alignment Learning

Latest papers 271

All topics
CardsList
  1. General Preference Reinforcement Learning

    May 18, 2026Muhammad Umer, Muhammad Ahmed Mohsin, Ahsan Bilal +5Large Language Model Reinforcement LearningPreference Alignment Learning

  2. GAMMA: Global Bit Allocation for Mixed-Precision Models under Arbitrary Budgets

    May 18, 2026Zhangyang Yao, Haiyan Zhao, Haoyu Wang +3Mixed-Precision QuantizationToken Budget Allocation

  3. ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks

    May 17, 2026Tianxiang Xu, Xiaoyan Zhu, Xin Lai +1Reinforcement Learning From Human FeedbackLarge Language Model Classification

  4. OHP-RL: Online Human Preference as Guidance in Reinforcement Learning for Robot Manipulation

    May 15, 2026Yunyang Mo, Jian Li, Qiwei Wu +2Reinforcement Learning From Human FeedbackRobotic Manipulation

  5. Contexting as Recommendation: Evolutionary Collaborative Filtering for Context Engineering

    May 15, 2026Jiachen Zhu, Zhuoying Ou, Congmin Zheng +9Collaborative FilteringRecommendation

  6. Active Learners as Efficient PRP Rerankers

    May 14, 2026Jeremías Figueiredo Paschmann, Juan Kaplan, Francisco Nattero +3Cross-Encoder RerankingRanking

  7. Direct Preference Optimization for English-Mandarin Code-Switching Speech Recognition in Audio LLMs

    May 13, 2026Trung Nguyen Quang, Cheng Yi Lewis Won, Minh Duc Pham +3Code-SwitchingLarge Audio Language Models

  8. Probing Persona-Dependent Preferences in Language Models

    May 13, 2026Oscar Gilg, Pierre Beckmann, Daniel Paleka +1Preference Alignment Learning

  9. Improving Code Translation with Syntax-Guided and Semantic-aware Preference Optimization

    May 13, 2026Yuhan Wu, Huan Zhang, Wei Cheng +3Code GenerationPreference Alignment Learning

  10. Variance-aware Reward Modeling with Anchor Guidance

    May 12, 2026Shuxing Fang, Ruijian Han, Liangyu Zhang +1Progress Reward ModelingPreference Alignment Learning

  11. Explaining and Breaking the Safety-Helpfulness Ceiling via Preference Dimensional Expansion

    May 12, 2026ShiYing Huang, Liang Lin, Yuer Li +6Preference AlignmentMulti-Objective Reinforcement Learning

  12. A Theory of Time-Sensitive Language Generation: Sparse Hallucination Beats Mode Collapse

    May 11, 2026Atul Ganju, Travis McVoy, Shaddin Dughmi +1DeadlinesInductive Bias

  13. When to Ask a Question: Understanding Communication Strategies in Generative AI Tools

    May 11, 2026Charlotte Park, Kate Donahue, Manish RaghavanGenerative Artificial IntelligenceElicitation

  14. DGPO: Beyond Pairwise Preferences with Directional Consistent Groupwise Optimization

    May 11, 2026Mengyi Deng, Zhiwei Li, Xin Li +4Backtranslation Augmented Direct Preference OptimizationPreference Alignment Learning

  15. Learning the Preferences of a Learning Agent

    May 9, 2026Karim Abdel Sadek, Mark Bedaywi, Rhys Gould +1Preference LearningReinforcement Learning From Human Feedback

  16. Personalized Alignment Revisited: The Necessity and Sufficiency of User Diversity

    May 9, 2026Enoch Hyunwook KangDiversityPreference Alignment Learning

  17. Mechanistic Analysis of Alignment Algorithms in Language Models

    May 9, 2026Aarush Sinha, Ishan Garg, Veeraraju Elluru +2Large Language Model AlignmentPreference Alignment Learning

  18. Can Revealed Preferences Clarify LLM Alignment and Steering?

    May 8, 2026Khurram Yamin, Jingjing Tang, Eric Horvitz +1Large Language Model AlignmentLarge Language Model Decisions

  19. Embeddings for Preferences, Not Semantics

    May 8, 2026Carter Blair, Ariel D. Procaccia, Milind TambePreference Alignment LearningText Embeddings

  20. Auto-Rubric as Reward: From Implicit Preferences to Explicit Multimodal Generative Criteria

    May 8, 2026Juanxi Tian, Fengyuan Liu, Jiaming Han +6Progress Reward ModelingTask-Specific Rubrics

  21. Nash without Numbers: A Social Choice Approach to Mixed Equilibria in Context-Ordinal Games

    May 8, 2026Ian Gemp, Crystal Qian, Marc Lanctot +1Nash EquilibriumEquilibrium

  22. Response Time Enhances Alignment with Heterogeneous Preferences

    May 7, 2026Federico Echenique, Alireza Fallah, Baihe Huang +1Preference Alignment LearningLarge Language Model Personalization

  23. Preference Instability in Reward Models: Detection and Mitigation via Sparse Autoencoders

    May 7, 2026Shunchang Liu, Xin Chen, Belen Martin Urcelay +1Preference LearningPreference Alignment Learning

  24. Misaligned by Reward: Socially Undesirable Preferences in LLMs

    May 6, 2026Gayane Ghazaryan, Esra DönmezLarge Language Model AlignmentLarge Language Model Bias

  25. StoryAlign: Evaluating and Training Reward Models for Story Generation

    May 6, 2026Haotian Xia, Hao Peng, Yunjia Qi +4Narrative GenerationNarratives

  26. Replacing Parameters with Preferences: Federated Alignment of Heterogeneous Vision-Language Models

    May 5, 2026Shule Lu, Yujing Wang, Hainan Zhang +5Vision-Language AlignmentRecent Vision-Language Models

  27. U-Define: Designing User Workflows for Hard and Soft Constraints in LLM-Based Planning

    May 4, 2026Christine P Lee, Xinyu Jessica Wang, Aws Albarghouthi +2Agentic Workflow DesignStructural Constraints

  28. Multi-User Dueling Bandits: A Fair Approach using Nash Social Welfare

    May 3, 2026Maheed H. Ahmed, Mahsa GhasemiAlgorithmic FairnessStochastic Multi-Armed Bandits

  29. RMGAP: Benchmarking the Generalization of Reward Models across Diverse Preferences

    May 3, 2026Yangyang Zhou, Yi-Chen LiProgress Reward ModelingLarge Language Model Alignment

  30. VLA-ATTC: Adaptive Test-Time Compute for VLA Models with Relative Action Critic Model

    May 2, 2026Wenhao Li, Xiu Su, Yichao Cao +5Diffusion-Based Vision-Language-ActionsCritic-Free Reinforcement Learning

  31. Mind the Gap: Structure-Aware Consistency in Preference Learning

    Apr 30, 2026Mehryar Mohri, Yutao ZhongLarge Language Model AlignmentPreference Alignment Learning

  32. When Agents Shop for You: Role Coherence in AI-Mediated Markets

    Apr 29, 2026Soogand Alavi, Salar NozariAgentic CommercePreference Alignment Learning

  33. On the Existence of an Inverse Solution for Preference-Based Reductions in Argumentation

    Apr 24, 2026Alessio Zaninotto, Bruno Yun, Nir Oren +1Argumentation FrameworksPreference Alignment Learning

  34. Preference Heads in Large Language Models: A Mechanistic Framework for Interpretable Personalization

    Apr 24, 2026Weixu Zhang, Ye Yuan, Changjiang Han +7Large Language Model PersonalizationPersonalization

  35. Preferences of a Voice-First Nation: Large-Scale Pairwise Evaluation and Preference Analysis for TTS in Indian Languages

    Apr 23, 2026Srija Anand, Ashwin Sankar, Ishvinder Sethi +10Seed-Tts-Eval BenchmarkMultilingual Automatic Speech Recognition

  36. Align Generative Artificial Intelligence with Human Preferences: A Novel Large Language Model Fine-Tuning Method for Online Review Management

    Apr 23, 2026Yanan Wang, Yong GePreference Alignment LearningReview

  37. Where and What: Reasoning Dynamic and Implicit Preferences in Situated Conversational Recommendation

    Apr 22, 2026Dongding Lin, Jian Wang, Yongqi Li +1Preference Alignment LearningMultimodal Large Language Models

  38. Vibrotactile Preference Learning: Uncertainty-Aware Preference Learning for Personalized Vibration Feedback

    Apr 22, 2026Rongtao Zhang, Xin Zhu, Masoume Pourebadi Khotbehsara +3Preference LearningHaptic Feedback

  39. HiPO: Hierarchical Preference Optimization for Adaptive Reasoning in LLMs

    Apr 22, 2026Darsh Kachroo, Arjun Prasaath Anbazhagan, Adriana Caraeni +2Sequential Preference OptimizationLLM Reasoning Strategies

  40. DT2IT-MRM: Debiased Preference Construction and Iterative Training for Multimodal Reward Modeling

    Apr 21, 2026Zhihong Zhang, Jie Zhao, Xiaojian Huang +5Multimodal Large Language ModelsMultimodal Dataset

  41. From Experience to Skill: Multi-Agent Generative Engine Optimization via Reusable Strategy Learning

    Apr 21, 2026Beining Wu, Fuyou Mao, Jiong Lin +7Agentic OptimizationCitations

  42. HorizonBench: Long-Horizon Personalization with Evolving Preferences

    Apr 19, 2026Shuyue Stella Li, Bhargavi Paranjape, Kerem Oktar +9Preference Alignment LearningInteraction History

  43. Beyond Overlap Metrics: Rewarding Reasoning and Preferences for Faithful Multi-Role Dialogue Summarization

    Apr 19, 2026Xiaoyong Mei, Tingting Zuo, Da Chen +5Dialogue BenchmarksSummarization

  44. Comparison Drives Preference: Reference-Aware Modeling for AI-Generated Video Quality Assessment

    Apr 18, 2026Minghao Zou, Gen Liu, Guanghui Yue +5Video QualityGenerative Video Models

  45. From "Strings" to "Things" for Personal Knowledge Graphs: Evaluating LLM Triple Extraction for Recommendation Systems

    Apr 18, 2026Abhirup Dasgupta, Fernando Spadea, Oshani SeneviratneRdfKnowledge Graphs

  46. Preference Estimation via Opponent Modeling in Multi-Agent Negotiation

    Apr 17, 2026Yuta Konishi, Kento Yamamoto, Eisuke Sonomoto +8NegotiationPreference Alignment Learning

  47. WavAlign: Enhancing Intelligence and Expressiveness in Spoken Dialogue Models via Adaptive Hybrid Post-Training

    Apr 16, 2026Yifu Chen, Shengpeng Ji, Qian Chen +9Speech Language ModelsPreference Alignment Learning

  48. CoPA: Benchmarking Personalized Question Answering with Data-Informed Cognitive Factors

    Apr 16, 2026Hang Su, Zequn Liu, Chen Hu +3Large Language Model PersonalizationPreference Alignment Learning

  49. Rater State Bias in RLHF Preference Data: An Audit Framework

    Apr 14, 2026Elena Kopteva, Vitaliy Hlynianyi-ZhukReinforcement Learning From Human FeedbackRater

  50. Coverage-Controlled Preference Mining from Noisy Claim Verification for Evidence-Grounded Generation

    Mar 11, 2026Weixin Liu, Congning Ni, Qingyuan Song +4Category-Aware Atomic ClaimsEvidence-Grounded Questions

  51. MARS: Margin and Semantic-Aware Data Augmentation for Reward Modeling

    Feb 19, 2026Payel Bhattacharjee, Osvaldo Simeone, Ravi TandonProgress Reward ModelingAugmentation