Preference Alignment Learning

Latest papers 271

All topics
CardsList
  1. Behavioral and Representational Evidence of Binomial Ordering Preferences in Large Language Models

    Jun 19, 2026Zhiqing Yang, Yilun Liu, Yunpu Ma +2Large Language Model BiasLinguistics

  2. Your Mouse and Eyes Secretly Leak Your Preference: LLM Alignment using Implicit Feedback from Users

    Jun 18, 2026Haw-Shiuan Chang, Jeffrey Gomez, Mehul Patwari +2Large Language Model AlignmentLarge Language Model Evaluation

  3. Through the PRISM: Preference Representation in Intermediate States of Video Diffusion Models

    Jun 18, 2026Haoxuan Wu, Lai Man Po, Mengyang Liu +3Video Diffusion ModelsVideo Foundation Models

  4. Beyond Uniform Forgetting: A Study of Sequential Direct Preference Optimization Across Preference Settings

    Jun 18, 2026Pranav Bhandari, Nicolas Fay, Amitava Datta +2Backtranslation Augmented Direct Preference OptimizationPreference Alignment Learning

  5. Steerable Cultural Preference Optimization of Reward Models

    Jun 17, 2026Minsik Oh, Advit Deepak, Sophie Wu +2Large Language Model AlignmentSequential Preference Optimization

  6. Prompt Perturbation for Reliable LLM Evaluation over Comparison Graphs

    Jun 16, 2026Dong Huang, Jianbo Sun, Pengkun YangLarge Language Model EvaluationRanking

  7. Whose hotel does the AI recommend? An algorithm audit of reputation signals in LLM-assisted hotel selection

    Jun 15, 2026Mirza Samad Ahmed Baig, Syeda Anshrah Gillani, Asher AliAirbnbRecommendation

  8. ChatPlanner: A Large Language Model Framework for Personalized Public Transit Routing

    Jun 13, 2026Tingting Yang, Chenhao Xue, Jun ChenLarge Language Model RoutingTransport

  9. TacStyle: Personalizing Tactile Robot Policies using Structured Behavior Representations

    Jun 12, 2026Kevin Robledo, Matías I. Torres Galaz, Kumar Dixhant Rai +3Robot PoliciesBehavior Tree

  10. LLMs Contain Multitudes: How Deployment Context Reshapes Model-Level Preferences and Values

    Jun 11, 2026Filip Trhlik, Aoife O'Flynn, Angela Yu +2Preference Alignment LearningValue

  11. Getting Better at Working With You: Compiling User Corrections into Runtime Enforcement for Coding Agents

    Jun 11, 2026Yujun Zhou, Kehan Guo, Haomin Zhuang +8Coding AgentsRuntime Enforcement

  12. DailyReport: An Open-ended Benchmark for Evaluating Search Agents on Daily Search Tasks

    Jun 11, 2026Jingxuan Han, Wei Liu, Mingyang Zhu +8Search AgentsAgentic Benchmarks

  13. Bandits for Efficient Experimentation: Adapting to Control Group, Preferences, and Context Drifts

    Jun 8, 2026Udvas Das, Waris Radji, Debabrota Basu +1BanditsPreference Alignment Learning

  14. Counterfactual Transport Flows for Offline Conservative Trajectory Refinement

    Jun 8, 2026Lena Krieger, Xuan Zhao, Zhuo Cao +3Model-Based Reinforcement LearningLong Refinement Trajectories

  15. DynaCF: Mitigating Shortcut Learning in Reward Models via Dynamic Counterfactual Sensitivity

    Jun 8, 2026Fengyuan Liu, Yongliang Miao, Zirui He +3Progress Reward ModelingPreference Alignment Learning

  16. ZIPP:Zero-shot Image Personalization from Personas

    Jun 7, 2026Harini SI, Somesh Singh, Yaman Kumar Singla +2Persona ConsistencyDiffusion Models

  17. Whose Norms? Disentangling Cultural and Personal Alignment in Large Language Models

    Jun 5, 2026Angana Borah, Isabelle Augenstein, Rada MihalceaLarge Language Model AlignmentLarge Language Model Bias

  18. What Do People Actually Want From AI? Mapping Preference Plurality

    Jun 4, 2026Julia Sepúlveda Coelho, Scott A. HaleArtificial Intelligence AlignmentPreference Alignment Learning

  19. Statistical Priors for Implicit Preferences: Decoupling Skill Selection as a Local Harness in Personal Agents

    Jun 4, 2026Zeyu Gan, Huayi Tang, Yong LiuPreference LearningLarge Language Model Personalization

  20. Rethinking Sales Lead Scoring with LLM-based Hierarchical Preference Ranking

    Jun 3, 2026Chenyu Zhang, Yiwen Liu, Yin Sun +4Sales LeadPreference Alignment Learning

  21. Sparse Mixture-of-Experts Reward Models Learn Interpretable and Specialized Experts for Personalized Preference Modeling

    Jun 2, 2026Yifan Wang, Jinyi Mu, Mayank Jobanputra +5Preference Alignment LearningExperts

  22. A Dataset for Dynamic Human Preferences for Vision Language Models

    Jun 2, 2026Hannah Gao, Dylan Hadfield-Menell, Rachel MaPreference DatasetsPreference Alignment Learning

  23. Follow-Your-Preference++: Rethinking Preference Alignment for Image Inpainting

    Jun 2, 2026Junkun Yuan, Yutao Shen, Toru Aonishi +2Preference AlignmentPreference Alignment Learning

  24. Memory Retrieval for Changing Preferences

    Jun 2, 2026Yuehan Qin, Li Li, Linxin Song +4Interaction HistoryPreference Alignment Learning

  25. Drifting Preference Optimization for One-Step Generative Models

    Jun 1, 2026Zhou Jiang, Yandong Wen, Zhen LiuDiffusion AlignmentFew-Step Generation

  26. Time-Aware Diffusion based on Preference Disentanglement for Generative Recommendation

    Jun 1, 2026Bangguo Zhu, Peng Huo, Yuanbo Zhao +3Real-World Content Recommendation ProblemPreference Alignment Learning

  27. From Reward-Free Representations to Preferences: Rethinking Offline Preference-Based Reinforcement Learning

    May 31, 2026Jun-Jie Yang, Chia-Heng Hsu, Kui-Yuan Chen +1Reinforcement Learning From Human FeedbackModel-Based Reinforcement Learning

  28. Skill or Skip? Learning Selective Skill Invocation in Agentic Tasks via Dual-Granularity Preference Learning

    May 30, 2026Chishui Chen, Jiaye Lin, Te Sun +6SkillsAgentic Reinforcement Learning

  29. Reinforcement Learning with Pairwise Preferences in Long-Term Decision Problems

    May 29, 2026Jonathan Colaço Carr, Prakash Panangaden, Doina Precup +1Markov Decision ProcessesOptimal Policies

  30. The Representation-Rationalizability Tradeoff in Reward Learning

    May 29, 2026Jing Dong, Yaoliang Yu, Pascal PourpartReinforcement Learning From Human FeedbackReward Functions

  31. Federated Variational Preference Alignment with Gumbel-Softmax Prior for Personalized User Preferences

    May 29, 2026Jabin Koo, Hoyoung Kim, Minwoo Jang +1Preference LearningPreference Alignment Learning

  32. In-Context Reward Adaptation for Robust Preference Modeling

    May 28, 2026Zhenyu Sun, Zheng Xu, Ermin WeiReinforcement Learning From Human FeedbackPreference Alignment Learning

  33. From Blind Guess to Informed Judgment: Teaching LLMs to Evaluate Materials by Building Knowledge-Augmented Preference Signals

    May 28, 2026Yeyong Yu, Wenya Hu, Xing Wu +1Data-Driven Materials DiscoveryMaterials

  34. Toward User Preference Alignment in LLM Recommendation via Explicit Context Feedback

    May 27, 2026Weizhi Zhang, Wooseong Yang, Yuxin Cui +9Preference Alignment LearningPreference Alignment

  35. AdaDPO: Self-Adaptive Direct Preference Optimization with Balanced Gradient Updates

    May 27, 2026Shaolong Chen, Madalina Ciobanu, Qingqing Mao +1Backtranslation Augmented Direct Preference OptimizationLarge Language Model Adaptation

  36. Rethinking Visual Neglect: Steering via Context-Preference for MLLM Hallucination Mitigation

    May 27, 2026Jingwen Wu, Xijun Zhang, Ge SongHallucination MitigationMultimodal Large Language Models

  37. StepOPSD: Step-Aware Online Preference Distillation for Agent Reinforcement Learning

    May 26, 2026Yanfei Zhang, Xu Lin, Chenglin WuOnline-Policy DistillationRp-Opsd

  38. Elias in the Lighthouse, Again? Diagnosing Low Diversity in LLM Stories

    May 26, 2026Sil Hamilton, David MimnoNarrative GenerationLarge Language Model Generation

  39. CroCo: Cross-Lingual Contrastive Preference Tuning on Self-Generations

    May 25, 2026Mike Zhang, Ali Basirat, Desmond ElliottMultilingual Language ModelsCross-Lingual Consistency

  40. Active Query Synthesis for Preference Learning

    May 25, 2026Namrata Nadagouda, Nauman Ahad, Maegan Tucker +1Preference LearningPool-Based Active Learning

  41. Preferred, Not Safer: Pairwise Preference Is a Poor Proxy for Clinical Safety

    May 25, 2026Fay Elhassan, David Sasu, Alexandra Kulinkina +2Large Language Model EvaluationSafety Claims

  42. When In-Distribution Gains Fail: Evaluating Weak-to-Strong Reward Models under Preference Shift

    May 25, 2026Khoi Le, Tri Cao, Phong Nguyen +5Preference LearningPreference Alignment Learning

  43. MATO: Multi-objective Personalized Alignment with Test-time Optimization for Large Language Models

    May 25, 2026Linhao Luo, Thuy-Trang Vu, Van-Anh Nguyen +3Large Language Model PersonalizationPreference Alignment Learning

  44. From Correctness to Preference: A Framework for Personalized Agentic Reinforcement Learning

    May 22, 2026Ranxu zhang, zeyang li, Jiacheng Huang +5Agentic Reinforcement LearningReward-Only Policy Optimization Variants

  45. Human-in-the-Loop Multi-Agent Ventilator Decision Support with Contextual Bandit Preference Learning

    May 22, 2026Sijia Li, Xiaoyu Tan, Qixing Wang +7Human-In-The-LoopReinforcement Learning From Human Feedback

  46. Building a privacy-preserving Federated Recommender system for mobile devices

    May 21, 2026Aasheesh SinghReal-World Content Recommendation ProblemPrivacy-Preserving Framework

  47. PRISM: Preference-Aware Influence Function Based Data Selection Method for Efficient Fine-Tuning

    May 20, 2026Qihao Lin, Guanxu Chen, Dongrui Liu +1Alignment-Aware SelectionModel Fine-Tuning

  48. APM: Evaluating Style Personalization in LLMs with Arbitrary Preference Mappings

    May 20, 2026Philipp Spohn, Leander Girrbach, Zeynep AkataLarge Language Model PersonalizationPersonalization

  49. When Preference Labels Fall Short: Aligning Diffusion Models from Real Data

    May 19, 2026Weiyan Chen, Weijian Deng, Yao Xiao +5Diffusion AlignmentPreference Alignment

  50. Efficient Elicitation of Collective Disagreements

    May 19, 2026Mohamed Ouaguenouni, Felipe Garrido-Lucero, Umberto Grandi +2DisagreementMajority Voting