Reward Modeling

Momentum

24 papers in the last four weeks, up 118% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 197

All topics
CardsList
  1. Reward Bias Substitution: Single-Axis Bias Mitigations Redirect Optimization Pressure

    May 27, 2026Max Lamparth, Daniel Fein, Andreas Haupt +2Reward ModelingRL for Language Models

  2. Tournament-GRPO: Group-Wise Tournament Rewards for Reinforcement Learning in Open-Ended Long-Form Generation

    May 26, 2026Zixuan Yang, Yiqun Chen, Wei Yang +7Open-Ended GenerationReward Modeling

  3. KARMA: Karma-Aligned Reward Model Adaptation

    May 26, 2026Jared Scott, Jesse RobertsReward ModelingRL for Language Models

  4. DyCoRM: Dynamic Criterion-Aware Reward Modeling for Text-to-Image Generation

    May 25, 2026Jiaying Qian, Ziheng Jia, Qian Zhang +5Reward ModelingT2I Generation

  5. When In-Distribution Gains Fail: Evaluating Weak-to-Strong Reward Models under Preference Shift

    May 25, 2026Khoi Le, Tri Cao, Phong Nguyen +5Pairwise Preference LearningReward Modeling

  6. How Neural Reward Models Learn Features for Policy Optimization: A Single-Index Analysis

    May 23, 2026Rei Higuchi, Ryotaro Kawata, Akifumi Wachi +3Reward ModelingRepresentation Learning

  7. UniSRM: A Unified Speech Reward Model for Reasoning-Based Fine-grained Assessment

    May 22, 2026Yuanyuan Wang, Dongchao Yang, Yayue Deng +4Reward ModelingSpeech Generation Evaluation

  8. Not Every Rubric Teaches Equally: Policy-Aware Rubric Rewards for RLVR

    May 19, 2026Utkarsh Tyagi, Xingang Guo, MohammadHossein Rezaei +5Reward ModelingRubric-Based RL

  9. ClaimDiff-RL: Fine-Grained Caption Reinforcement Learning through Visual Claim Comparison

    May 19, 2026Tianle Li, Xuyang Shen, Yan Ma +7VLM EvaluationReward Modeling

  10. PAIR: Prefix-Aware Internal Reward Model for Multi-Turn Agent Optimization

    May 18, 2026Wonjoong Kim, Yeonjun In, Sangwu Park +2Reward ModelingCredit Assignment in RL

  11. ClaHF: A Human Feedback-inspired Reinforcement Learning Framework for Improving Classification Tasks

    May 17, 2026Tianxiang Xu, Xiaoyan Zhu, Xin Lai +1Reward ModelingReinforcement Learning

  12. Transitivity Meets Cyclicity: Explicit Preference Decomposition for Dynamic Large Language Model Alignment

    May 17, 2026Yucong Huang, Xiucheng Li, Kaiqi Zhao +1Reward ModelingLLM Alignment

  13. Step-wise Rubric Rewards for LLM Reasoning

    May 17, 2026Weichu Xie, Haozhe Zhao, Wenpu Liu +15Reward ModelingCredit Assignment in RL

  14. Process Rewards with Learned Reliability

    May 15, 2026Jinyuan Li, Langlin Huang, Chengsong Huang +5Reward ModelingProcess Reward Models

  15. Variance-aware Reward Modeling with Anchor Guidance

    May 12, 2026Shuxing Fang, Ruijian Han, Liangyu Zhang +1Pairwise Preference LearningReward Modeling

  16. Unsupervised Process Reward Models

    May 11, 2026Artyom Gadetsky, Maxim Kodryan, Siba Smarak Panigrahi +2Reward ModelingProcess Reward Models

  17. FormalRewardBench: A Benchmark for Formal Theorem Proving Reward Models

    May 11, 2026Zeynel A. Uluşan, Burak S. Akbudak, Can S. Erer +1Reward ModelingAutomated Theorem Proving

  18. Test-Time Personalization: A Diagnostic Framework and Probabilistic Fix for Scaling Failures

    May 9, 2026Linhai Zhang, Yulan HeReward ModelingReward Hacking

  19. RewardHarness: Self-Evolving Agentic Post-Training

    May 9, 2026Yuxuan Zhang, Penghui Du, Bo Li +11Reward ModelingImage Editing Evaluation

  20. Video Understanding Reward Modeling: A Robust Benchmark and Performant Reward Models

    May 8, 2026Yuancheng Wei, Linli Yao, Lei Li +4Reward ModelingMultimodal Reward Modeling

  21. Preference Instability in Reward Models: Detection and Mitigation via Sparse Autoencoders

    May 7, 2026Shunchang Liu, Xin Chen, Belen Martin Urcelay +1Reward ModelingSparse Autoencoders

  22. On Training in Imagination

    May 7, 2026Nadav Timor, Ravid Shwartz-Ziv, Micah Goldblum +2Reward ModelingReinforcement Learning

  23. Optimal Transport for LLM Reward Modeling from Noisy Preference

    May 7, 2026Licheng Pan, Haochen Yang, Haoxuan Li +8Reward ModelingNoisy-Label Learning

  24. Think, then Score: Decoupled Reasoning and Scoring for Video Reward Modeling

    May 7, 2026Yuan Wang, Ouxiang Li, Yulong Xu +8Reward ModelingMultimodal Reward Modeling

  25. Misaligned by Reward: Socially Undesirable Preferences in LLMs

    May 6, 2026Gayane Ghazaryan, Esra DönmezReward ModelingLanguage Model Safety Evaluation

  26. StoryAlign: Evaluating and Training Reward Models for Story Generation

    May 6, 2026Haotian Xia, Hao Peng, Yunjia Qi +4Reward ModelingLanguage Model Generation Evaluation