Preference Optimization

Momentum

13 papers in the last four weeks, up 30% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 98

All topics
CardsList
  1. Temporal Concentration from Rollout Errors: Implicit Preference Optimization for Text-to-Video Diffusion

    Jul 30, 2026Henglin Liu, Fangyuan Kong, Jing Wang +7Diffusion Model AlignmentVideo Diffusion Models

  2. AutoPref: Automatic Discovery of Task-Specific Preference Objectives for Neural Combinatorial Optimization

    Jul 30, 2026Shengda Gu, Kai Li, Xinyi Ke +3Automated Algorithm DiscoveryPairwise Preference Evaluation

  3. BridgeAlign: Bridging Preference Alignment for Humanities and Social Sciences

    Jul 29, 2026Ru Peng, Haokai Xu, Xijun Gu +11Pairwise Preference LearningPreference Optimization

  4. TELLER: Dual-Path Iterative Preference Optimization for Table Entity Linking

    Jul 29, 2026Yixin Peng, Kehao Li, Stefan DeckerDirect Preference OptimizationPreference Optimization

  5. Less Data, Better Alignment: Data-Centric Multi-Evaluator Agreement for Preference Optimization

    Jul 27, 2026Zhengtao Yao, Runhao Li, Xupeng Chen +12Preference Optimization

  6. RIMS: Preference Optimization via Smoothed Multi-pair Aggregation for Small-Scale LLM Retrieval-Augmented Generation

    Jul 17, 2026Pei Tian, Zihan Dong, Tianci Liu +2Retrieval-Augmented GenerationSmall Language Models

  7. TD-DPO: Difference-Aware Preference Optimization for Mitigating Sycophancy in Clinical Autism Intervention Dialogue

    Jul 17, 2026Shuzhong Lai, Junhong Lai, Chenxi Li +5LLM SycophancyDirect Preference Optimization

  8. Groc-PO: Grounded Context Preference Optimization for Truthful Multimodal LLMs

    Jul 15, 2026Zhixiao Zheng, Zheren Fu, Zhiyuan Yao +3Multimodal GroundingMultimodal Large Language Models

  9. Exploring Post-Training Alignment of Small Language Models for Biomedical Data-to-Text Generation: A Case Study of Medication Leaflet

    Jul 15, 2026Xi Yang, Guodong Liu, Chuqin Li +10LLM AlignmentSmall Language Models

  10. Direct Image-to-Modern Vietnamese Translation of Han-Nom Manuscripts via Multimodal RLHF Preference Alignment

    Jul 13, 2026Thi Kim Trang Vo, Nghia Hieu Nguyen, Ha Minh TanDirect Preference OptimizationPreference Optimization

  11. PORTS: Preference-Optimized Retrievers for Tool Selection with Large Language Models

    Jul 3, 2026Lorenzo Molfetta, Giacomo Frisoni, Nicolò Monaldini +1Preference OptimizationLLM Tool Use

  12. Distributionally Robust Listwise Preference Optimization

    Jul 2, 2026Xudong Wu, Jian Qian, Pangpang Liu +2LLM AlignmentDistributionally Robust Optimization

  13. RSICCLLM: A Multimodal Large Language Model for Remote Sensing Image Change Captioning

    Jun 26, 2026Yelin Wang, Zijia Song, Shuo Ye +6Remote Sensing Image UnderstandingVLM Adaptation

  14. OracleAnalyser: Analysing Implicit Semantics of Oracle Bone Scripts through MLLMs with Post-training

    Jun 24, 2026Zijia Song, Yelin Wang, Zhengyi Ma +5VLM ReasoningPreference Optimization

  15. Beyond Uniform Forgetting: A Study of Sequential Direct Preference Optimization Across Preference Settings

    Jun 18, 2026Pranav Bhandari, Nicolas Fay, Amitava Datta +2Continual Learning for LLMsDirect Preference Optimization

  16. Temporal Preference Optimization for Unsupervised Retrieval

    Jun 16, 2026HyunJin Kim, Jaejun Shim, Young Jin Kim +1Temporal IRPreference Optimization

  17. PVminerLLM2: Improving Structured Extraction of Patient Voice via Preference Optimization

    Jun 15, 2026Samah Fodeh, Linhai Ma, Ganesh Puthiaraju +7HealthcareClinical Information Extraction

  18. PolyAlign: Conditional Human-Distribution Alignment

    Jun 11, 2026L. D. M. S. Sai Teja, Ufaq Khan, Sathira Silva +2Multilingual Language ModelsLLM Alignment

  19. Emo-LiPO: Listwise Preference Optimization for Fine-Grained Emotion Intensity Control in LLM-based Text-to-Speech

    Jun 11, 2026Yihang Lin, Li Zhou, Congwei Cao +4TTS SynthesisPreference Optimization

  20. FoA-SR: Faithful or Aesthetic? Profile-Aware Preference Optimization for Real-World Image Super-Resolution

    Jun 9, 2026Amjad Mahdi Alqarni, Peizhong JuDiffusion Models for Image RestorationPreference Optimization

  21. ThoughtFold: Folding Reasoning Chains via Introspective Preference Learning

    Jun 2, 2026Ziyan Liu, Xueda Shen, Yuzhe Gu +7Efficient Language Model ReasoningPreference Optimization

  22. Drifting Preference Optimization for One-Step Generative Models

    Jun 1, 2026Zhou Jiang, Yandong Wen, Zhen LiuDiffusion Model AlignmentOne-Step Generative Modeling

  23. Human Label Variation as Stable Signal: Learning Annotator-Specific Explanation Behavior via Cross-Annotator Preference Optimization

    May 27, 2026Beiduo Chen, Pingjun Hong, Ziyun Zhang +3LLM-Assisted AnnotationPreference Optimization