Backtranslation Augmented Direct Preference Optimization

Latest papers 50

All topics
CardsList
  1. Uncertainty-Normalized Margins for Direct Preference Optimization

    Sep 29, 2026Sadegh Khorasani, Petrus Mikkola, Matthias GrossglauserBacktranslation Augmented Direct Preference OptimizationPreference Alignment Learning

  2. Latent evolving World Action Model

    Sep 23, 2026Xueji Fang, Boqiang Duan, Hua Wu +2Action GenerationWorld Models

  3. Beyond Safe Answers: Segment-Aware Listwise Alignment for Reasoning Safety in Large Reasoning Models

    Sep 14, 2026JungMin Yun, Junehyoung Kwon, Hayeong Ryu +3Large Reasoning ModelsReasoning Skills

  4. Direct Preference Density Alignment for Conversational Audio Equalization

    Sep 14, 2026Ioannis Stylianou, Sven Ewan Shepstone, Jon Francombe +2Backtranslation Augmented Direct Preference OptimizationLarge Language Model Alignment

  5. Direct Diversity Optimization for Diverse Successful Trajectories in Preference Post-Training

    Sep 9, 2026Junwon Ko, Dong-Jae Lee, Minchan Kwon +2Post-TrainingBacktranslation Augmented Direct Preference Optimization

  6. SSPO: Structure-Aware Similarity-Weighted Preference Optimization for Neural Combinatorial Optimization

    Aug 12, 2026Yuanyu Li, Jintao Xu, Zijiang Liu +6Neural Combinatorial OptimizationBacktranslation Augmented Direct Preference Optimization

  7. Context Blindness in DPO: Mitigating Object Hallucination in MLLMs via Context-Calibrated Preference Optimization

    Aug 12, 2026Byungoh Ko, Jinyoung Park, Jongha Kim +3Hallucination MitigationObject Hallucination

  8. Se-DPO: Self-Evolving Token Credit for Direct Preference Optimization

    Aug 10, 2026Wenxiao Zhao, Shu Wang, Ying Nian WuBacktranslation Augmented Direct Preference OptimizationCredit Assignment

  9. Learning When to Trust via Selective Context Preference Optimization

    Aug 6, 2026Xian Sun, Wei Chow, Yingshuo Wang +4Large Language Model ReliabilityAI Trustworthiness

  10. Rolling With Resistance: Preference-Optimized LLM Counselors Can Trade Goal Persistence for Relational Attunement in Motivational Interviewing

    Jul 30, 2026Weiying Chen, Junlong Shen, Zhexuan TangIntrinsic MotivationCounseling

  11. TELLER: Dual-Path Iterative Preference Optimization for Table Entity Linking

    Jul 29, 2026Yixin Peng, Kehao Li, Stefan DeckerEntitiesBacktranslation Augmented Direct Preference Optimization

  12. Unbiased Alignment for Large Language Models with Noisy Preferences

    Jul 3, 2026Jialiang Wang, Xianming Liu, Xiong Zhou +2Backtranslation Augmented Direct Preference OptimizationReinforcement Learning From Human Feedback

  13. Distributionally Robust Listwise Preference Optimization

    Jul 2, 2026Xudong Wu, Jian Qian, Pangpang Liu +2Sequential Preference OptimizationBacktranslation Augmented Direct Preference Optimization

  14. Weight-Space Geometry of Offline Reasoning Training

    Jun 21, 2026Aleksandr Nikolich, Igor Kiselev, Vladimir Platonov +1Weight-SpaceBacktranslation Augmented Direct Preference Optimization

  15. Beyond Uniform Forgetting: A Study of Sequential Direct Preference Optimization Across Preference Settings

    Jun 18, 2026Pranav Bhandari, Nicolas Fay, Amitava Datta +2Backtranslation Augmented Direct Preference OptimizationPreference Alignment Learning

  16. AdaDPO: Self-Adaptive Direct Preference Optimization with Balanced Gradient Updates

    May 27, 2026Shaolong Chen, Madalina Ciobanu, Qingqing Mao +1Backtranslation Augmented Direct Preference OptimizationLarge Language Model Adaptation

  17. Reasoning Matters: Mitigate Hallucination in Multimodal Large Reasoning Models via Reasoning-Conditioned Preference Optimization

    May 27, 2026Jiawei Kong, Hao Fang, Shunxiang Liao +5Multimodal ReasoningHallucination Mitigation

  18. Token-weighted Direct Preference Optimization with Attention

    May 21, 2026Chengyu Huang, Zhuohang Li, Sheng-Yen Chou +1Backtranslation Augmented Direct Preference OptimizationReward Functions

  19. Linear-DPO: Linear Direct Preference Optimization for Diffusion and Flow-Matching Generative Models

    May 20, 2026Kesong Li, Yixuan Xu, Kuo-kun Tseng +3Text-To-Image Diffusion ModelsDiffusion Models

  20. Conditional Equivalence of DPO and RLHF: Implicit Assumption, Failure Modes, and Provable Alignment

    May 20, 2026Zhiqin Yang, Yonggang Zhang, Wei Xue +3Backtranslation Augmented Direct Preference OptimizationReinforcement Learning From Human Feedback

  21. Distributed Direct Preference Optimization

    May 20, 2026Zhanhong JiangBacktranslation Augmented Direct Preference OptimizationDecentralized Learning

  22. BSO: Safety Alignment Is Density Ratio Matching

    May 12, 2026Tien-Phat Nguyen, Truong Nguyen, Thin Nguyen +3Safety AlignmentLarge Language Model Alignment

  23. DGPO: Beyond Pairwise Preferences with Directional Consistent Groupwise Optimization

    May 11, 2026Mengyi Deng, Zhiwei Li, Xin Li +4Backtranslation Augmented Direct Preference OptimizationPreference Alignment Learning

  24. ξξ-DPO: Direct Preference Optimization via Ratio Reward Margin

    May 9, 2026Zhengyuan Fan, Zhonghua Wu, Yuxuan Du +1Backtranslation Augmented Direct Preference Optimization

  25. Gradient-Gated DPO: Stabilizing Preference Optimization in Language Models

    May 4, 2026Inoussa Mouiche, Abderaouf BahiBacktranslation Augmented Direct Preference Optimization

  26. Efficient Preference Poisoning Attack on Offline RLHF

    May 4, 2026Chenye Yang, Weiyu Xu, Lifeng LaiBacktranslation Augmented Direct Preference OptimizationReinforcement Learning From Human Feedback

  27. Backtranslation Augmented Direct Preference Optimization for Neural Machine Translation

    Apr 28, 2026Mehrdad Ghassabi, Spehr Rajabi, Hamidreza Baradaran Kashani +3Neural Machine TranslationBacktranslation Augmented Direct Preference Optimization

  28. Aligning with Your Own Voice: Self-Corrected Preference Learning for Hallucination Mitigation in LVLMs

    Apr 27, 2026Byeonggeuk Lim, JungMin Yun, Junehyoung Kwon +2Hallucination MitigationPreference Datasets

  29. GroupDPO: Memory-Efficient Group-Wise Direct Preference Optimization

    Apr 17, 2026Jixuan Leng, Si Si, Hsiang-Fu Yu +2Backtranslation Augmented Direct Preference Optimization

  30. Multi-dimensional Preference Alignment by Conditioning Reward Itself

    Dec 11, 2025Jiho Jang, Jinyoung Kim, Kyungjune Baek +1Diffusion AlignmentBacktranslation Augmented Direct Preference Optimization

  31. DPO Unchained: Your Training Algorithm is Secretly Disentangled in Human Choice Theory (and its Loss' Convexity is Dispensable)

    Jul 10, 2025Wenxuan Zhou, Shujian Zhang, Brice Magdalou +4Backtranslation Augmented Direct Preference OptimizationNonconvex

  32. Beyond Single-Negative Preference: Multi-Negative DPO for LLM-Centric Historical Entity Linking

    Date pendingTien Nam Nguyen, Emanuela Boros, Ahmed Hamdi +3Backtranslation Augmented Direct Preference OptimizationHistory