Preference Learning

Latest papers 56

All topics
CardsList
  1. Inherited Learning in an Artificial Ecology: How Controls and Update Allocation Shape Benefits

    Oct 1, 2026Xuening Wu, Lei Li, Shan YuPreference LearningLearn

  2. On the Complexity of Preference-Based Bandits

    Sep 30, 2026Ahmed Ben Yahmed, Marc Abeille, Clément CalauzènesPreference Learning

  3. Optimal Design for Active Preference Learning with Biased LLM Judges

    Sep 30, 2026Zhongman Du, Huiming Zhang, Haodong Zhu +1Preference LearningPreference Alignment Learning

  4. Context-Continuous Preference Learning for Exoskeleton Personalization

    Sep 23, 2026Sunin Baek, Sungwoo Park, Daekyum KimPreference LearningExoskeleton

  5. Learning Heterogeneous Preferences

    Sep 15, 2026Shiwali Mohan, Matt Hong, Dule Shu +3Preference LearningPreference Alignment Learning

  6. Preference Optimization with LALM Feedback for Continuous Autoregressive Non-Verbal Vocalization Generation

    Sep 10, 2026Jingbin Hu, Qirui Zhan, Yuang Cao +7Preference LearningFeedback

  7. You Can't Prefer Emotions You Don't Sample: Intensity Undershoot in DPO-Tuned LLMs

    Sep 7, 2026Hyunwoo Kim, Usama KhalidValence-Arousal EstimationEmotion

  8. Interoceptive Attention as Dynamic Homeostatic Prioritization in a Foraging Agent

    Aug 4, 2026St John Grimbly, Nicolas Kuske, Evert A. Boonstra +7Predator-Prey ModelsPreference Learning

  9. An analysis of machine learning approaches for enhancing decision-making in complex discrete choice tasks

    Jul 30, 2026Sheng Lun Christine Cao, Destenie Nock, Alex DavisDiscrete Choice ModelsPreference Learning

  10. TELLER: Dual-Path Iterative Preference Optimization for Table Entity Linking

    Jul 29, 2026Yixin Peng, Kehao Li, Stefan DeckerEntitiesBacktranslation Augmented Direct Preference Optimization

  11. Step-Level Preference Learning for Generative Agents in Social Simulations

    Jul 16, 2026Wenchang Gao, Pingyue Sheng, Lanlan Qiu +7Preference LearningSimulation-Based Reinforcement Learning

  12. Internal Pluralism and the Limits of Pairwise Comparisons

    Jul 2, 2026Bailey Flanigan, Michelle SiInternal PluralismPreference Learning

  13. SPLC: Social Preference Learning for Crowd Robot Navigation

    Jul 2, 2026Zixuan Chen, Hao Fu, Haiwen Hu +1Robot NavigationHuman-Robot Collaboration

  14. Scaling Trends for Lie Detector Oversight in Preference Learning

    Jul 2, 2026Oskar J. Hollinsworth, Ann-Kathrin Dombrowski, Sam Adam-Day +2DeceptionPreference Learning

  15. Freeform Preference Learning for Robotic Manipulation

    Jun 30, 2026Marcel Torne, Anubha Mahajan, Abhijnya Bhat +1Robot PoliciesRobotic Manipulation

  16. MAPL: Multi-Objective Preference Learning for Robot Locomotion

    Jun 24, 2026Xiyue Chen, Muhan Lin, Shuyang Shi +1Multi-Objective Reinforcement LearningPreference Learning

  17. Towards Spec Learning: Inference-Time Alignment from Preference Pairs

    Jun 22, 2026Dhriti Krishnan, Tejas Goyal, Jaromir SavelkaPreference LearningPreference Alignment Learning

  18. Self-Evolution for Multi-Turn Tool-Calling Agents via Divergence-Point Preference Learning

    Jun 22, 2026Jiaqiang TangPreference LearningSelf-Evolution

  19. Improving Code-Switching ASR with Code-Mixing Guided Synthetic Speech

    Jun 14, 2026Yue Heng Yeo, Haoyang Li, Yizhou Peng +6Code-SwitchingAutomatic Speech Recognition

  20. S2^2COPE: Self-Supervised Concept Discovery via Preference Learning

    Jun 12, 2026Shilong Xiang, Zirui Zhang, Chengzhi MaoUnsupervisedPreference Learning

  21. PAWS: Preference Learning with Advantage-Weighted Segments

    Jun 10, 2026Aleksandar Taranovic, Onur Celik, Niklas Freymuth +6Preference LearningTrajectory-Level Credit

  22. A Regret Minimization Framework on Preference Learning in Large Language Models

    Jun 8, 2026Suhwan Kim, Taehyun Cho, Geon-Hyeong Kim +4Reinforcement Learning From Human FeedbackSequential Preference Optimization

  23. Statistical Priors for Implicit Preferences: Decoupling Skill Selection as a Local Harness in Personal Agents

    Jun 4, 2026Zeyu Gan, Huayi Tang, Yong LiuPreference LearningLarge Language Model Personalization

  24. ThoughtFold: Folding Reasoning Chains via Introspective Preference Learning

    Jun 2, 2026Ziyan Liu, Xueda Shen, Yuzhe Gu +7Large Reasoning ModelsReasoning Chain

  25. Skill or Skip? Learning Selective Skill Invocation in Agentic Tasks via Dual-Granularity Preference Learning

    May 30, 2026Chishui Chen, Jiaye Lin, Te Sun +6SkillsAgentic Reinforcement Learning

  26. Federated Variational Preference Alignment with Gumbel-Softmax Prior for Personalized User Preferences

    May 29, 2026Jabin Koo, Hoyoung Kim, Minwoo Jang +1Preference LearningPreference Alignment Learning

  27. Reward Learning from Best-of-NN Preference Data: Targets, Tradeoffs, and Design Principles

    May 28, 2026Rattana Pukdee, Maria-Florina Balcan, Pradeep RavikumarBest-Of-NPreference Learning

  28. Calibrated Preference Learning: The Case of Label Ranking

    May 28, 2026Santo M. A. R. Thies, Viktor Bengs, Timo Kaufmann +2RankingPreference Learning

  29. Hallucination Detection-Guided Preference Optimization for Clinical Summarization

    May 27, 2026Shamanth Kuthpadi Seethakantha, Dung Ngoc Thai, Vara Prasad Gudi +6SummarizationHallucination Detection

  30. Optimising Factual Consistency in Summarisation via Preference Learning from Multiple Imperfect Metrics

    May 26, 2026Yuxuan Ye, Raul Santos-Rodriguez, Edwin SimpsonSummarizationFacts

  31. Active Query Synthesis for Preference Learning

    May 25, 2026Namrata Nadagouda, Nauman Ahad, Maegan Tucker +1Preference LearningPool-Based Active Learning

  32. When In-Distribution Gains Fail: Evaluating Weak-to-Strong Reward Models under Preference Shift

    May 25, 2026Khoi Le, Tri Cao, Phong Nguyen +5Preference LearningPreference Alignment Learning

  33. Learning Kernel-Based MDPs from Episodic Preferential Feedback

    May 22, 2026Nikola Pavlovic, Sattar Vakili, Qing ZhaoReinforcement Learning From Human FeedbackPreference Learning

  34. Convex Optimization for Alignment and Preference Learning on a Single GPU

    May 22, 2026Miria Feng, Mert PilanciPreference LearningConvex Optimization

  35. Learning the Preferences of a Learning Agent

    May 9, 2026Karim Abdel Sadek, Mark Bedaywi, Rhys Gould +1Preference LearningReinforcement Learning From Human Feedback

  36. Compressed Video Aggregator: Content-driven Module for Efficient Micro-Video Recommendation

    May 9, 2026Yang Xiao, Huiyuan Chen, Kaiyuan Deng +5Short Video BurstsVideo Compression

  37. Multi-Objective Constraint Inference using Inverse reinforcement learning

    May 7, 2026Syed Ihtesham Hussain Shah, Floris den Hengst, Aneta Lisowska +1Multi-Objective Reinforcement LearningConstraint Satisfaction

  38. Preference Instability in Reward Models: Detection and Mitigation via Sparse Autoencoders

    May 7, 2026Shunchang Liu, Xin Chen, Belen Martin Urcelay +1Preference LearningPreference Alignment Learning

  39. PREFER: Personalized Review Summarization with Online Preference Learning

    May 7, 2026Millend Roy, Agostino Capponi, Vineet GoyalSummarizationPreference Learning

  40. PrefMoE: Robust Preference Modeling with Mixture-of-Experts Reward Learning

    May 1, 2026Ziqin Yuan, Ruiqi Wang, Dezhong Zhao +2Preference Learning

  41. Aligning with Your Own Voice: Self-Corrected Preference Learning for Hallucination Mitigation in LVLMs

    Apr 27, 2026Byeonggeuk Lim, JungMin Yun, Junehyoung Kwon +2Hallucination MitigationPreference Datasets

  42. Vibrotactile Preference Learning: Uncertainty-Aware Preference Learning for Personalized Vibration Feedback

    Apr 22, 2026Rongtao Zhang, Xin Zhu, Masoume Pourebadi Khotbehsara +3Preference LearningHaptic Feedback

  43. PREF-XAI: Preference-Based Personalized Rule Explanations of Black-Box Machine Learning Models

    Apr 21, 2026Salvatore Greco, Jacek Karolczak, Roman Słowiński +1Explainable Artificial IntelligencePreference Learning

  44. Cat-DPO: Category-Adaptive Safety Alignment

    Apr 19, 2026Tiankai Yang, Yi Nian, Xinyuan Li +3Safety AlignmentLarge Language Model Alignment

  45. N2M: Bridging Navigation and Manipulation by Learning Pose Preference from Rollout

    Sep 23, 2025Kaixin Chai, Hyunjun Lee, Joseph J. LimRobotic Manipulation PoliciesPreference Learning

  46. Interactive Multi-Objective Probabilistic Preference Learning with Soft and Hard Bounds

    Jun 27, 2025Edward Chen, Sang T. Truong, Natalie Dullerud +2Pareto FrontierPreference Learning