Pairwise Preference Learning

Momentum

12 papers in the last four weeks, up 300% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 81

All topics
CardsList
  1. Offline Preference Optimization for Rectified Flow with Noise-Tracked Pairs

    May 10, 2026Yunhong Lu, Qichao Wang, Hengyuan Cao +2Pairwise Preference LearningRectified Flow

  2. ξξ-DPO: Direct Preference Optimization via Ratio Reward Margin

    May 9, 2026Zhengyuan Fan, Zhonghua Wu, Yuxuan Du +1Pairwise Preference LearningDirect Preference Optimization

  3. Response Time Enhances Alignment with Heterogeneous Preferences

    May 7, 2026Federico Echenique, Alireza Fallah, Baihe Huang +1Pairwise Preference LearningLLM Alignment

  4. Pair2Score: Pairwise-to-Absolute Transfer for LLM-Based Essay Scoring

    May 3, 2026İbrahim Rıza Hallaç, Hasan OğulPairwise Preference LearningPairwise Comparison

  5. Multi-User Dueling Bandits: A Fair Approach using Nash Social Welfare

    May 3, 2026Maheed H. Ahmed, Mahsa GhasemiPairwise Preference LearningMulti-Armed Bandits

  6. Mind the Gap: Structure-Aware Consistency in Preference Learning

    Apr 30, 2026Mehryar Mohri, Yutao ZhongPairwise Preference LearningLLM Alignment

  7. Preferences of a Voice-First Nation: Large-Scale Pairwise Evaluation and Preference Analysis for TTS in Indian Languages

    Apr 23, 2026Srija Anand, Ashwin Sankar, Ishvinder Sethi +10Pairwise Preference LearningHuman Preference Evaluation

  8. Vibrotactile Preference Learning: Uncertainty-Aware Preference Learning for Personalized Vibration Feedback

    Apr 22, 2026Rongtao Zhang, Xin Zhu, Masoume Pourebadi Khotbehsara +3Pairwise Preference LearningHaptic Feedback

  9. Towards Disentangled Preference Optimization Dynamics: Suppress the Loser, Preserve the Winner

    Apr 20, 2026Wei Chen, Yubing Wu, Junmei Yang +5Pairwise Preference LearningLLM Alignment

  10. Efficient Personalization of Generative User Interfaces

    Apr 10, 2026Yi-Hao Peng, Jeffrey P. Bigham, Jason WuPairwise Preference LearningHuman Preference Modeling

  11. Not All Preferences Deserve Gradients: Understanding Gradient Utility in Offline Reasoning Alignment

    Feb 1, 2026Hui Wu, Hengyi Cai, Jinman Zhao +6Pairwise Preference LearningTraining Data Selection

  12. Adaptive Margin RLHF via Preference over Preferences

    Sep 26, 2025Yaswanth Chittepu, Prasann Singhal, Greg Durrett +1Pairwise Preference LearningReward Modeling

  13. Dropping Just a Handful of Preferences Can Change Top Large Language Model Rankings

    Aug 16, 2025Jenny Y. Huang, Yunyi Shen, Dennis Wei +1Pairwise Preference LearningLLM Evaluation

  14. MiCRo: Mixture Modeling and Context-aware Routing for Personalized Preference Learning

    May 30, 2025Jingyan Shen, Jiarui Yao, Rui Yang +5Pairwise Preference LearningReward Modeling

  15. Dual-Difficulty Curriculum Learning for Direct Preference Optimization

    Apr 10, 2025Mengyang Li, Haozhan Geng, Zhong Zhang +1Pairwise Preference LearningLLM Alignment