Pairwise Preference Learning

Momentum

12 papers in the last four weeks, up 300% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 81

All topics
CardsList
  1. Covariate-dependent Joint Modeling of Multivariate Ordinal Preferences and Its Connections with Comparison Models

    Oct 6, 2026Yujie Chen, Antik Chakraborty, Anindya BhadraPreference LearningOrdinal Regression

  2. Groupwise Distortion Guarantees for Preference-Based Alignment

    Oct 4, 2026Jacob Brodkey, Roberto Tamez, Aaron RothPairwise Preference LearningSocial Choice Theory

  3. On the Complexity of Preference-Based Bandits

    Sep 30, 2026Ahmed Ben Yahmed, Marc Abeille, Clément CalauzènesPairwise Preference LearningMulti-Armed Bandits

  4. Optimal Design for Active Preference Learning with Biased LLM Judges

    Sep 30, 2026Zhongman Du, Huiming Zhang, Haodong Zhu +1Pairwise Preference LearningLLM Alignment

  5. Uncertainty-Normalized Margins for Direct Preference Optimization

    Sep 29, 2026Sadegh Khorasani, Petrus Mikkola, Matthias GrossglauserPairwise Preference LearningDirect Preference Optimization

  6. Using Context Is Not Enough: Test-Time Training for Personalized Reward Modeling

    Sep 28, 2026Bohao Wang, Xiaoyan Zhao, Yang Zhang +4Pairwise Preference LearningReward Modeling

  7. From Soft Targets to Reward Signals: How Assignment and Reward Objectives Interact

    Sep 28, 2026Jiangtao Lin, Bangyang Wei, Siyi Liu +2Pairwise Preference LearningReward Modeling

  8. PrefLUT: Reusable and Refinable Personalized Color Editing from Pairwise Preferences

    Sep 28, 2026Chuanzhi Xu, Langyi Chen, Chengkun Yue +5Pairwise Preference LearningUser Preference Modeling

  9. A Zeroth-Order Paradigm for LLM Preference Alignment

    Sep 16, 2026Peter Chen, Xi Chen, Wotao Yin +1Pairwise Preference LearningLLM Alignment

  10. Learning Heterogeneous Preferences

    Sep 15, 2026Shiwali Mohan, Matt Hong, Dule Shu +3Pairwise Preference LearningHuman Preference Modeling

  11. FlowCPO: A Unified Divergence View of Preference Alignment for Flow Models

    Sep 9, 2026Yansen Han, Shengyi Liao, Peng Sun +4Pairwise Preference LearningFlow Matching

  12. Finding the Signal in the Spam: Jointly Learning Rewards and Worker Reliability from Pairwise Comparisons

    Aug 10, 2026Kaustubh Shivshankar Shejole, Tanish Agarwal, Arpit Agarwal +1Pairwise Preference LearningReward Modeling

  13. Isotonic Bradley-Terry Model for Paired Comparison Data

    Aug 3, 2026Ryoya YamasakiPairwise Preference LearningPairwise Comparison

  14. Rethinking Personalized Reward Modeling for LLMs under Preference Heterogeneity via Group-Debiased Federated Learning

    Aug 3, 2026Seongyoon Kim, Boryeong Cho, Jihwan Oh +2Pairwise Preference LearningReward Modeling

  15. Ranking Infrared-Visible Fusion the Way Humans Do: A Learned Pairwise Preference Measure

    Aug 2, 2026Haoran Liu, Mingzhe Liu, Peng Li +1Pairwise Preference LearningMulti-Source Image Fusion

  16. BridgeAlign: Bridging Preference Alignment for Humanities and Social Sciences

    Jul 29, 2026Ru Peng, Haokai Xu, Xijun Gu +11Pairwise Preference LearningPreference Optimization

  17. CSPF: A Constrained Shared-Private Fusion Method for Non-Verifiable Preference Evaluation

    Jul 23, 2026Hehao Zhang, Danli Wang, Xinyuan Wang +1Pairwise Preference LearningReward Modeling

  18. Generalizing Preference-based Reinforcement Learning: a Rationality Model for Incomparability

    Jul 13, 2026Simone Drago, Marco Mussi, Leonardo Bianconi +1Pairwise Preference LearningPairwise Comparison

  19. Comparison-Based Ordinal Learning for Proactive Driving Risk Assessment

    Jul 13, 2026Zhuoren Li, Yi Zhong, Weiqi Zhang +4Pairwise Preference LearningCollision Avoidance

  20. Optimal Top-kk Identification from Pairwise Comparisons

    Jul 9, 2026Motti Goldberger, Nils RudiPairwise Preference LearningMulti-Armed Bandits

  21. Attention Limited Reward Learning

    Jul 6, 2026Wenqian XingPairwise Preference LearningReward Modeling

  22. Unbiased Alignment for Large Language Models with Noisy Preferences

    Jul 3, 2026Jialiang Wang, Xianming Liu, Xiong Zhou +2Pairwise Preference LearningLLM Alignment