Offline Preference Optimization

Latest papers 8

All topics
CardsList
  1. Latent evolving World Action Model

    Sep 23, 2026Xueji Fang, Boqiang Duan, Hua Wu +2Joint-Embedding Predictive ArchitectureAction-Conditioned World Models

  2. FlowCPO: A Unified Divergence View of Preference Alignment for Flow Models

    Sep 9, 2026Yansen Han, Shengyi Liao, Peng Sun +4Pairwise Preference LearningFlow Matching

  3. Offline Preference Optimization for Rectified Flow with Noise-Tracked Pairs

    May 10, 2026Yunhong Lu, Qichao Wang, Hengyuan Cao +2Pairwise Preference LearningRectified Flow

  4. Arena as Offline Reward: Efficient Fine-Grained Preference Optimization for Diffusion Models

    May 7, 2026Zhikai Li, Yue Zhao, Edward Zhongwei Zhang +4Diffusion Model AlignmentPreference Optimization

  5. Intrinsic Mutual Information as a Modulator for Preference Optimization

    Apr 27, 2026Peng Liao, Peijia Zheng, Lingbo Li +2LLM AlignmentOffline Preference Optimization

  6. Not All Preferences Deserve Gradients: Understanding Gradient Utility in Offline Reasoning Alignment

    Feb 1, 2026Hui Wu, Hengyi Cai, Jinman Zhao +6Pairwise Preference LearningTraining Data Selection