Reward Modeling

Momentum

24 papers in the last four weeks, up 118% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 197

All topics
CardsList
  1. Reward Bias Substitution: Single-Axis Bias Mitigations Redirect Optimization Pressure

    May 27, 2026Max Lamparth, Daniel Fein, Andreas Haupt +2Reward ModelingRL for Language Models

  2. Tournament-GRPO: Group-Wise Tournament Rewards for Reinforcement Learning in Open-Ended Long-Form Generation

    May 26, 2026Zixuan Yang, Yiqun Chen, Wei Yang +7Open-Ended GenerationReward Modeling

  3. KARMA: Karma-Aligned Reward Model Adaptation

    May 26, 2026Jared Scott, Jesse RobertsReward ModelingRL for Language Models

  4. DyCoRM: Dynamic Criterion-Aware Reward Modeling for Text-to-Image Generation

    May 25, 2026Jiaying Qian, Ziheng Jia, Qian Zhang +5Reward ModelingT2I Generation

  5. When In-Distribution Gains Fail: Evaluating Weak-to-Strong Reward Models under Preference Shift

    May 25, 2026Khoi Le, Tri Cao, Phong Nguyen +5Pairwise Preference LearningReward Modeling

  6. How Neural Reward Models Learn Features for Policy Optimization: A Single-Index Analysis

    May 23, 2026Rei Higuchi, Ryotaro Kawata, Akifumi Wachi +3Reward ModelingRepresentation Learning

  7. UniSRM: A Unified Speech Reward Model for Reasoning-Based Fine-grained Assessment

    May 22, 2026Yuanyuan Wang, Dongchao Yang, Yayue Deng +4Reward ModelingSpeech Generation Evaluation

  8. Not Every Rubric Teaches Equally: Policy-Aware Rubric Rewards for RLVR

    May 19, 2026Utkarsh Tyagi, Xingang Guo, MohammadHossein Rezaei +5Reward ModelingRubric-Based RL

  9. ClaimDiff-RL: Fine-Grained Caption Reinforcement Learning through Visual Claim Comparison

    May 19, 2026Tianle Li, Xuyang Shen, Yan Ma +7VLM EvaluationReward Modeling

  10. PAIR: Prefix-Aware Internal Reward Model for Multi-Turn Agent Optimization

    May 18, 2026Wonjoong Kim, Yeonjun In, Sangwu Park +2Reward ModelingCredit Assignment in RL

  11. ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks

    May 17, 2026Tianxiang Xu, Xiaoyan Zhu, Xin Lai +1Reward ModelingReinforcement Learning

  12. Transitivity Meets Cyclicity: Explicit Preference Decomposition for Dynamic Large Language Model Alignment

    May 17, 2026Yucong Huang, Xiucheng Li, Kaiqi Zhao +1Reward ModelingLLM Alignment

  13. Step-wise Rubric Rewards for LLM Reasoning

    May 17, 2026Weichu Xie, Haozhe Zhao, Wenpu Liu +15Reward ModelingCredit Assignment in RL

  14. Process Rewards with Learned Reliability

    May 15, 2026Jinyuan Li, Langlin Huang, Chengsong Huang +5Reward ModelingProcess Reward Models

  15. Variance-aware Reward Modeling with Anchor Guidance

    May 12, 2026Shuxing Fang, Ruijian Han, Liangyu Zhang +1Pairwise Preference LearningReward Modeling

  16. Unsupervised Process Reward Models

    May 11, 2026Artyom Gadetsky, Maxim Kodryan, Siba Smarak Panigrahi +2Reward ModelingProcess Reward Models

  17. FormalRewardBench: A Benchmark for Formal Theorem Proving Reward Models

    May 11, 2026Zeynel A. Uluşan, Burak S. Akbudak, Can S. Erer +1Reward ModelingAutomated Theorem Proving

  18. Test-Time Personalization: A Diagnostic Framework and Probabilistic Fix for Scaling Failures

    May 9, 2026Linhai Zhang, Yulan HeReward ModelingReward Hacking

  19. RewardHarness: Self-Evolving Agentic Post-Training

    May 9, 2026Yuxuan Zhang, Penghui Du, Bo Li +11Reward ModelingImage Editing Evaluation

  20. Video Understanding Reward Modeling: A Robust Benchmark and Performant Reward Models

    May 8, 2026Yuancheng Wei, Linli Yao, Lei Li +4Reward ModelingMultimodal Reward Modeling

  21. Preference Instability in Reward Models: Detection and Mitigation via Sparse Autoencoders

    May 7, 2026Shunchang Liu, Xin Chen, Belen Martin Urcelay +1Reward ModelingSparse Autoencoders

  22. On Training in Imagination

    May 7, 2026Nadav Timor, Ravid Shwartz-Ziv, Micah Goldblum +2Reward ModelingReinforcement Learning

  23. Optimal Transport for LLM Reward Modeling from Noisy Preference

    May 7, 2026Licheng Pan, Haochen Yang, Haoxuan Li +8Reward ModelingNoisy-Label Learning

  24. Think, then Score: Decoupled Reasoning and Scoring for Video Reward Modeling

    May 7, 2026Yuan Wang, Ouxiang Li, Yulong Xu +8Reward ModelingMultimodal Reward Modeling

  25. Misaligned by Reward: Socially Undesirable Preferences in LLMs

    May 6, 2026Gayane Ghazaryan, Esra DönmezReward ModelingLanguage Model Safety Evaluation

  26. StoryAlign: Evaluating and Training Reward Models for Story Generation

    May 6, 2026Haotian Xia, Hao Peng, Yunjia Qi +4Reward ModelingLanguage Model Generation Evaluation

  27. Efficiently Aligning Language Models with Online Natural Language Feedback

    May 5, 2026Christine Ye, Joe BentonReward ModelingRL for Language Models

  28. FINER-SQL: Boosting Small Language Models for Text-to-SQL

    May 5, 2026Thanh Dat Hoang, Thanh Trung Huynh, Matthias Weidlich +4Reward ModelingSmall Language Models

  29. Replacing Parameters with Preferences: Federated Alignment of Heterogeneous Vision-Language Models

    May 5, 2026Shule Lu, Yujing Wang, Hainan Zhang +5Reward ModelingPreference Optimization

  30. RMGAP: Benchmarking the Generalization of Reward Models across Diverse Preferences

    May 3, 2026Yangyang Zhou, Yi-Chen LiReward ModelingLLM Evaluation

  31. Adaptive Pluralistic Alignment: A pipeline for dynamic artificial democracy

    May 2, 2026Rachel FreedmanReward ModelingLLM Alignment

  32. Themis: Training Robust Multilingual Code Reward Models for Flexible Multi-Criteria Scoring

    May 1, 2026Indraneil Paul, Goran Glavaš, Iryna GurevychReward ModelingReward Model Evaluation

  33. PrefMoE: Robust Preference Modeling with Mixture-of-Experts Reward Learning

    May 1, 2026Ziqin Yuan, Ruiqi Wang, Dezhong Zhao +2Reward ModelingMixture of Experts

  34. AesRM: Improving Video Aesthetics with Expert-Level Feedback

    Apr 30, 2026Yujin Han, Yujie Wei, Yefei He +7Reward ModelingVideo Quality Assessment

  35. Leveraging Verifier-Based Reinforcement Learning in Image Editing

    Apr 30, 2026Hanzhong Guo, Jie Wu, Jie Liu +6Reward ModelingReinforcement Learning

  36. Debiasing Reward Models via Causally Motivated Inference-Time Intervention

    Apr 30, 2026Kazutoshi Shinoda, Kosuke Nishida, Kyosuke NishidaReward ModelingLLM Alignment

  37. From Coarse to Fine: Benchmarking and Reward Modeling for Writing-Centric Generation Tasks

    Apr 30, 2026Qingyu Ren, Tianjun Pan, Xingzhou Chen +1Reward ModelingRL for Language Models

  38. When Errors Can Be Beneficial: A Categorization of Imperfect Rewards for Policy Gradient

    Apr 28, 2026Shuning Shang, Hubert Strauss, Stanley Wei +2Reward ModelingPolicy Gradient

  39. Model-Free Inference of Investor Preferences: A Relative Entropy IRL Approach

    Apr 27, 2026Chen XuReward ModelingReinforcement Learning

  40. Explanation Quality Assessment as Ranking with Listwise Rewards

    Apr 27, 2026Thomas Bailleux, Tanmoy Mukherjee, Emmanuel Lonca +2Reward ModelingLearning to Rank

  41. ARES: Adaptive Red-Teaming and End-to-End Repair of Policy-Reward System

    Apr 20, 2026Jiacheng Liang, Yao Ma, Tharindu Kumarage +5Reward ModelingAdversarial Attacks on LLMs

  42. QuantumQA: Enhancing Scientific Reasoning via Physics-Consistent Dataset and Verification-Aware Reinforcement Learning

    Apr 20, 2026Songxin Qu, Tai-Ping Sun, Yun-Jie Wang +8Reward ModelingScientific QA

  43. TinyJudge: Unverifiable Constraint Alignment via Lightweight Specialist Ensembles

    Apr 19, 2026Yirong Zeng, Yufei Liu, Xiao Ding +9Reward ModelingLLM Alignment

  44. AgentV-RL: Scaling Reward Modeling with Agentic Verifier

    Apr 17, 2026Jiazheng Zhang, Ziche Fu, Zhiheng Xi +13Reward ModelingRL for Language Model Reasoning

  45. Unbiased Reward Modeling from Implicit Feedback for LLM Alignment

    Mar 24, 2026Hao Wang, Haocheng Yang, Licheng Pan +7Reward ModelingLLM Alignment

  46. When Rubrics Fail: Error Enumeration as Reward in Reference-Free RL Post-Training for Virtual Try-On

    Mar 5, 2026Wisdom Ikezogwo, Mehmet Saygin Seyfioglu, Ranjay Krishna +1Reward ModelingReference-Free Evaluation

  47. MARS: Margin and Semantic-Aware Data Augmentation for Reward Modeling

    Feb 19, 2026Payel Bhattacharjee, Osvaldo Simeone, Ravi TandonReward ModelingSynthetic Data Augmentation

  48. GRRM: Group Relative Reward Modeling for Machine Translation

    Feb 15, 2026Sen Yang, Shanbo Cheng, Lu Xu +2Reward ModelingRL for Language Models

  49. Small Reward Models via Backward Inference

    Feb 14, 2026Yike Wang, Faeze Brahman, Shangbin Feng +3Reward ModelingRL for Language Models

  50. Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation

    Feb 10, 2026Pei-Chi Pan, Yingbin Liang, Sen LinReward ModelingReward Hacking

  51. Joint Reward Modeling: Internalizing Chain-of-Thought for Efficient Visual Reward Models

    Feb 7, 2026Yankai Yang, Yancheng Long, Hongyang Wei +12Reward ModelingMultimodal Reward Modeling

  52. CodeScaler: Scaling Code LLM Training and Test-Time Inference via Reward Models

    Feb 4, 2026Xiao Zhu, Xinyu Zhou, Boyu Zhu +5RL for Code GenerationReward Modeling