Reward Modeling

Momentum

24 papers in the last four weeks, up 118% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 197

All topics
CardsList
  1. Efficiently Aligning Language Models with Online Natural Language Feedback

    May 5, 2026Christine Ye, Joe BentonReward ModelingRL for Language Models

  2. FINER-SQL: Boosting Small Language Models for Text-to-SQL

    May 5, 2026Thanh Dat Hoang, Thanh Trung Huynh, Matthias Weidlich +4Reward ModelingSmall Language Models

  3. Replacing Parameters with Preferences: Federated Alignment of Heterogeneous Vision-Language Models

    May 5, 2026Shule Lu, Yujing Wang, Hainan Zhang +5Reward ModelingPreference Optimization

  4. RMGAP: Benchmarking the Generalization of Reward Models across Diverse Preferences

    May 3, 2026Yangyang Zhou, Yi-Chen LiReward ModelingLLM Evaluation

  5. Adaptive Pluralistic Alignment: A pipeline for dynamic artificial democracy

    May 2, 2026Rachel FreedmanReward ModelingLLM Alignment

  6. Themis: Training Robust Multilingual Code Reward Models for Flexible Multi-Criteria Scoring

    May 1, 2026Indraneil Paul, Goran Glavaš, Iryna GurevychReward ModelingReward Model Evaluation

  7. PrefMoE: Robust Preference Modeling with Mixture-of-Experts Reward Learning

    May 1, 2026Ziqin Yuan, Ruiqi Wang, Dezhong Zhao +2Reward ModelingMixture of Experts

  8. AesRM: Improving Video Aesthetics with Expert-Level Feedback

    Apr 30, 2026Yujin Han, Yujie Wei, Yefei He +7Reward ModelingVideo Quality Assessment

  9. Leveraging Verifier-Based Reinforcement Learning in Image Editing

    Apr 30, 2026Hanzhong Guo, Jie Wu, Jie Liu +6Reward ModelingReinforcement Learning

  10. Debiasing Reward Models via Causally Motivated Inference-Time Intervention

    Apr 30, 2026Kazutoshi Shinoda, Kosuke Nishida, Kyosuke NishidaReward ModelingLLM Alignment

  11. From Coarse to Fine: Benchmarking and Reward Modeling for Writing-Centric Generation Tasks

    Apr 30, 2026Qingyu Ren, Tianjun Pan, Xingzhou Chen +1Reward ModelingRL for Language Models

  12. When Errors Can Be Beneficial: A Categorization of Imperfect Rewards for Policy Gradient

    Apr 28, 2026Shuning Shang, Hubert Strauss, Stanley Wei +2Reward ModelingPolicy Gradient

  13. Model-Free Inference of Investor Preferences: A Relative Entropy IRL Approach

    Apr 27, 2026Chen XuReward ModelingReinforcement Learning

  14. Explanation Quality Assessment as Ranking with Listwise Rewards

    Apr 27, 2026Thomas Bailleux, Tanmoy Mukherjee, Emmanuel Lonca +2Reward ModelingLearning to Rank

  15. ARES: Adaptive Red-Teaming and End-to-End Repair of Policy-Reward System

    Apr 20, 2026Jiacheng Liang, Yao Ma, Tharindu Kumarage +5Reward ModelingAdversarial Attacks on LLMs

  16. QuantumQA: Enhancing Scientific Reasoning via Physics-Consistent Dataset and Verification-Aware Reinforcement Learning

    Apr 20, 2026Songxin Qu, Tai-Ping Sun, Yun-Jie Wang +8Reward ModelingScientific QA

  17. TinyJudge: Unverifiable Constraint Alignment via Lightweight Specialist Ensembles

    Apr 19, 2026Yirong Zeng, Yufei Liu, Xiao Ding +9Reward ModelingLLM Alignment

  18. AgentV-RL: Scaling Reward Modeling with Agentic Verifier

    Apr 17, 2026Jiazheng Zhang, Ziche Fu, Zhiheng Xi +13Reward ModelingRL for Language Model Reasoning

  19. Unbiased Reward Modeling from Implicit Feedback for LLM Alignment

    Mar 24, 2026Hao Wang, Haocheng Yang, Licheng Pan +7Reward ModelingLLM Alignment

  20. When Rubrics Fail: Error Enumeration as Reward in Reference-Free RL Post-Training for Virtual Try-On

    Mar 5, 2026Wisdom Ikezogwo, Mehmet Saygin Seyfioglu, Ranjay Krishna +1Reward ModelingReference-Free Evaluation

  21. MARS: Margin and Semantic-Aware Data Augmentation for Reward Modeling

    Feb 19, 2026Payel Bhattacharjee, Osvaldo Simeone, Ravi TandonReward ModelingSynthetic Data Augmentation

  22. GRRM: Group Relative Reward Modeling for Machine Translation

    Feb 15, 2026Sen Yang, Shanbo Cheng, Lu Xu +2Reward ModelingRL for Language Models

  23. Small Reward Models via Backward Inference

    Feb 14, 2026Yike Wang, Faeze Brahman, Shangbin Feng +3Reward ModelingRL for Language Models

  24. Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation

    Feb 10, 2026Pei-Chi Pan, Yingbin Liang, Sen LinReward ModelingReward Hacking

  25. Joint Reward Modeling: Internalizing Chain-of-Thought for Efficient Visual Reward Models

    Feb 7, 2026Yankai Yang, Yancheng Long, Hongyang Wei +12Reward ModelingMultimodal Reward Modeling

  26. CodeScaler: Scaling Code LLM Training and Test-Time Inference via Reward Models

    Feb 4, 2026Xiao Zhu, Xinyu Zhou, Boyu Zhu +5RL for Code GenerationReward Modeling