Preference Alignment Learning

Latest papers 271

All topics
CardsList
  1. Personalized Group Relative Policy Optimization for Heterogenous Preference Alignment

    Feb 17, 2026Jialu Wang, Heinrich Peters, Asad A. Butt +6Preference AlignmentLarge Language Model Personalization

  2. SpreadsheetArena: Decomposing Preference in LLM Generation of Spreadsheet Workbooks

    Feb 16, 2026Srivatsa Kundurthy, Clara Na, Michael Handley +5SpreadsheetsLarge Language Model Generation

  3. Synthetic Interaction Data for Scalable Personalization in Large Language Models

    Feb 12, 2026Yuchen Ma, Yue Huang, Wenjie Wang +3Large Language Model PersonalizationPersonalization

  4. Online Generalized-Mean Welfare Maximization: Achieving Near-Optimal Regret from Samples

    Feb 11, 2026Zongjun Yang, Rachitesh Kumar, Christian Kroer\Widetilde{\Mathcal{O}}(\Sqrt{T})$ RegretWelfare

  5. Aligning Language Model Benchmarks with Pairwise Preferences

    Feb 2, 2026Marco Gutierrez, Xinyi Leng, Hannah Cyberey +3Large Language Model BenchmarksPreference Alignment Learning

  6. Not All Preferences Deserve Gradients: Understanding Gradient Utility in Offline Reasoning Alignment

    Feb 1, 2026Hui Wu, Hengyi Cai, Jinman Zhao +6GradientPreference Alignment Learning

  7. The Axiom of Consent: Authorization, Friction, and Multi-Agent Coordination

    Jan 10, 2026Murad FarzullaMulti-Agent CoordinationFriction

  8. Who Laughs with Whom? Disentangling Influential Factors in Humor Preferences across User Clusters and LLMs

    Jan 6, 2026Soichiro Murakami, Hidetaka Kamigaito, Hiroya Takamura +1HumorLarge Language Model Bias

  9. PreferThinker: Reasoning-based Personalized Image Preference Assessment

    Nov 1, 2025Shengqi Xu, Xinpeng Zhou, Yabo Zhang +6Preference Alignment LearningThink

  10. GMTRouter: Personalized LLM Router over Multi-turn User Interactions

    Oct 29, 2025Yihang Sun, Encheng Xie, Tao Feng +1Large Language Model RoutingLarge Language Model Personalization

  11. TripScore: Aligning LLMs for Real-World Travel Planning via Expert-Calibrated Reward

    Oct 10, 2025Yincen Qu, Huan Xiao, Feng Li +5JourneyReward Functions

  12. Adaptive Margin RLHF via Preference over Preferences

    Sep 26, 2025Yaswanth Chittepu, Prasann Singhal, Greg Durrett +1Reinforcement Learning From Human FeedbackPreference Alignment Learning

  13. Understanding Role Switching in Human-AI Collaboration through Multimodal Behavioral Signals

    Sep 25, 2025Avinash Ajit Nargund, Arthur Caetano, Kevin Yang +7Human-Ai CollaborationCollaboration

  14. Learning Acrobatic Flight from Preferences

    Aug 26, 2025Colin Merk, Ismail Geles, Jiaxu Xing +3Preference Alignment Learning

  15. Dropping Just a Handful of Preferences Can Change Top Large Language Model Rankings

    Aug 16, 2025Jenny Y. Huang, Yunyi Shen, Dennis Wei +1RankingChatbot Arena

  16. Expert Preference-based Evaluation of Automated Related Work Generation

    Aug 11, 2025Furkan Şahinuç, Subhabrata Dutta, Iryna GurevychPeer ReviewEvaluation Metrics

  17. Interactive Multi-Objective Probabilistic Preference Learning with Soft and Hard Bounds

    Jun 27, 2025Edward Chen, Sang T. Truong, Natalie Dullerud +2Pareto FrontierPreference Learning

  18. Similarity as Reward Alignment: Robust and Versatile Preference-based Reinforcement Learning

    Jun 14, 2025Sara Rajaram, R. James Cotton, Fabian H. SinzReinforcement Learning From Human FeedbackPreference Alignment Learning

  19. MiCRo: Mixture Modeling and Context-aware Routing for Personalized Preference Learning

    May 30, 2025Jingyan Shen, Jiarui Yao, Rui Yang +5Large Language Model PersonalizationPreference Alignment Learning

  20. Modeling and Optimizing User Preferences in AI Copilots: A Comprehensive Survey and Taxonomy

    May 28, 2025Saleh Afzoon, Ali Shahsavandi, Phuong Thao Huynh +4CopilotPreference Alignment Learning

  21. Dual-Difficulty Curriculum Learning for Direct Preference Optimization

    Apr 10, 2025Mengyang Li, Haozhan Geng, Zhong Zhang +1Large Language Model AlignmentAdaptive Curriculum

  22. Inferring the Unspoken: Aligning Embodied Agents with Implicit Preferences

    Feb 2, 2025Manjie Xu, Xinyi Yang, Wei Liang +2Embodied AgentsEmbodied

  23. Stable Marriage Problems with Ties and Incomplete Preferences: An Empirical Comparison of ASP, SAT, ILP, CP, and Local Search Methods

    Aug 11, 2021Selin Eyupoglu, Muge Fidan, Yavuz Gulesen +5SatisfiabilityLinear Programming

  24. Toward Collective-Centric Evaluation of Preference Inference for Participatory Democracy

    Date pendingPierre-Antoine Lequeu, Salim Hafid, Paul Lerner +6DemocracyPreference Alignment Learning

  25. Using Reward Uncertainty to Induce Diverse Behaviour in Reinforcement Learning

    Date pendingAnthony GX-Chen, Ankit Anand, Gheorghe Comanici +7Reward FunctionsOffline Reinforcement Learning

  26. SAEExplainer: Interpreting SAE Features with Activation-Guided Preference Optimization

    Date pendingJingyi He, Haiyan Zhao, Ruxue Shi +4Sparse Autoencoder FeaturesExplainable AI Methods

  27. PACIFIC: Can LLMs Discern the Psychometric Traits Influencing Your Preferences? Personality-Driven Preference Alignment in LLMs

    Date pendingTianyu Zhao, Siqi Li, Yasser Shoukry +1Preference AlignmentPreference Alignment Learning

  28. Beyond Single-Negative Preference: Multi-Negative DPO for LLM-Centric Historical Entity Linking

    Date pendingTien Nam Nguyen, Emanuela Boros, Ahmed Hamdi +3Backtranslation Augmented Direct Preference OptimizationHistory

  29. Left-Branching Transformers Excel at Right-Branching Languages: Data Shapes Word Order Preferences in Language Models

    Date pendingVarvara Arzt, Allan Hanbury, Terra BlevinsLanguage ModelingLanguage Pairs

  30. The C-index illusion: discrimination without calibration in published survival models

    Date pendingRafael da Silva, Danilo AlvaresSurvival PredictionsSurvival Analysis