Preference Datasets

Momentum

0 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 6Week of Sep 21

Latest papers 26

All topics
CardsList
  1. VA-Judger: Reward Modeling from Human Preference Feedback for Joint Video-Audio Generation

    Aug 19, 2026Yinming Huang, Shuyuan Tu, Xi Yan +6Audio-Video GenerationPreference Datasets

  2. What do Reward Models Memorize?

    Jul 27, 2026Ivo Verhoeven, Pushkar Mishra, Ekaterina ShutovaProgress Reward ModelingPreference Datasets

  3. Rushes: A Human Preference Dataset for Pluralistic Alignment

    Jul 22, 2026Michael Xu, Jorge Leandro, Sudha Rao +5Preference DatasetsPluralistic Alignment

  4. A Method for Learning Value Systems in Generative AI

    Jul 18, 2026Andrés Holgado-Sánchez, Holger Billhardt, Sascha OssowskiArtificial Intelligence AlignmentGenerative Artificial Intelligence

  5. Genre Bias or Aesthetic Perception? Identifying and Mitigating Shortcut Learning in Music Evaluation

    Jul 15, 2026Yizhou Zhang, Wangjin Zhou, Yi Zhao +3AestheticsModel Evaluation

  6. PLURAL: A Global Dataset for Value Alignment

    Jul 9, 2026Dhruv Agarwal, Anya Shukla, Tanya Goyal +1Preference DatasetsPluralistic Alignment

  7. Improving Text-to-Music Generation with Human Preference Rewards

    Jun 19, 2026Yonghyun Kim, Junwon Lee, Haiwen Xia +2Text-To-MusicPreference Datasets

  8. TuneJury: An Open Metric for Improving Music Generation Preference Alignment

    Jun 15, 2026Yonghyun Kim, Junwon Lee, Haiwen Xia +5Text-To-MusicSong Generation

  9. HPSv3++: Scaling Reward Models Across the Full Spectrum of Diffusion Model Capabilities

    Jun 12, 2026Yijun Liu, Jie Huang, Zeyue Xue +5Text-To-ImagePreference Datasets

  10. DOG-DPO:Dynamic Optimization in Geometry for Safety Alignment

    Jun 4, 2026Yi Nian, Tiankai Yang, Yudi Zhang +7Safety AlignmentLarge Language Model Alignment

  11. A Dataset for Dynamic Human Preferences for Vision Language Models

    Jun 2, 2026Hannah Gao, Dylan Hadfield-Menell, Rachel MaPreference DatasetsPreference Alignment Learning

  12. Differentially Private Preference Data Synthesis for Large Language Model Alignment

    May 29, 2026Fengyu Gao, Jing YangPreference AlignmentLarge Language Model Alignment

  13. Compositional Text-to-Image Generation Via Region-aware Bimodal Direct Preference Optimization

    May 27, 2026Zhuohan Liu, Wujian Peng, Yitong Chen +1Text-To-ImageText Generation

  14. Implicit Safety Alignment from Crowd Preferences

    May 20, 2026Qian Lin, Daniel S. BrownReinforcement Learning From Human FeedbackSafety Alignment

  15. TASTE: A Designer-Annotated Multi-Dimensional Preference Dataset for AI-Generated Graphic Design

    May 20, 2026Haonan Zhu, Elad Hirsch, Alexandria Minetti +3Modern Text-To-Image ModelsPreference Datasets

  16. AutoRubric-T2I: Robust Rule-Based Reward Model for Text-to-Image Alignment

    May 17, 2026Kuei-Chun Kao, Daixuan Huo, Yuanhao Ban +1Preference DatasetsText Generation

  17. RewardHarness: Self-Evolving Agentic Post-Training

    May 9, 2026Yuxuan Zhang, Penghui Du, Bo Li +11Progress Reward ModelingMulti-Image Editing Benchmarks

  18. StoryAlign: Evaluating and Training Reward Models for Story Generation

    May 6, 2026Haotian Xia, Hao Peng, Yunjia Qi +4Narrative GenerationNarratives

  19. APEX: Large-scale Multi-task Aesthetic-Informed Popularity Prediction for AI-Generated Music

    May 5, 2026Jaavid Aktar Husain, Dorien HerremansSong GenerationAesthetics

  20. ViPO: Visual Preference Optimization at Scale

    Apr 27, 2026Ming Li, Jie Wu, Justin Cui +3Preference DatasetsSingle-Cell Foundation Models

  21. Aligning with Your Own Voice: Self-Corrected Preference Learning for Hallucination Mitigation in LVLMs

    Apr 27, 2026Byeonggeuk Lim, JungMin Yun, Junehyoung Kwon +2Hallucination MitigationPreference Datasets

  22. Aligning Language Models for Lyric-to-Melody Generation with Rule-Based Musical Constraints

    Apr 20, 2026Hao Meng, Siyuan Zheng, Shuran Zhou +2Large Language Model AlignmentPreference Datasets

  23. Synthetic Interaction Data for Scalable Personalization in Large Language Models

    Feb 12, 2026Yuchen Ma, Yue Huang, Wenjie Wang +3Large Language Model PersonalizationPersonalization

  24. Shapley-based Data Valuation for LLM Alignment via Sequential Preference Optimization

    Dec 12, 2025Mélissa Tamine, Otmane Sakhi, Benjamin Heymann +2Large Language Model AlignmentSequential Preference Optimization

  25. Value Drifts: Tracing Value Alignment During LLM Post-Training

    Oct 30, 2025Mehar Bhatia, Shravan Nayak, Gaurav Kamath +4Large Language Model AlignmentPreference Datasets