Reward Shaping

Momentum

12 papers in the last four weeks, up 300% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 89

All topics
CardsList
  1. LLM-ALSO: LLM-Driven Adaptive Learning-Signal Optimization for Multi-Agent Reinforcement Learning

    May 28, 2026Xiaoguang Wu, Zhi Zheng, Hui XiongReward ShapingLLM-Guided RL

  2. A Heuristic Approach for Performance Tuning in RL-based Quadrotor Control via Reward Design and Termination Conditions

    May 18, 2026Fausto Mauricio Lagos Suarez, Akshit Saradagi, Vidya Sumathy +1RL ControlRobot Trajectory Tracking

  3. AMARIS: A Memory-Augmented Rubric Improvement System for Rubric-Based Reinforcement Learning

    May 18, 2026Peilin Wu, Xinlu Zhang, Kun Wan +4RL for Language ModelsReinforcement Learning

  4. AtlasVA: Self-Evolving Visual Skill Memory for Teacher-Free VLM Agents

    May 18, 2026Pan Wang, Yihao Hu, Xiujin Liu +3Memory-Augmented VLMsReward Shaping

  5. Leveraging Error Diversity in Group Rollouts for Reinforcement Learning

    May 17, 2026Wenpu Liu, Yuqi Xu, Weichu Xie +8Reward ShapingRL for Language Model Reasoning

  6. Beyond Safety Filtering: Control Barrier Function-Informed Reinforcement Learning for Connected and Automated Vehicles

    May 16, 2026Jianye Xu, Bassam AlrifaeeReward ShapingControl Barrier Functions

  7. Ensuring Logic in the Fog: Sound POMDP Synthesis with LTL Objectives

    May 12, 2026Can Zhou, Yulong Gao, Pian YuBelief-Space PlanningReward Shaping

  8. PhysEDA: Physics-Aware Learning Framework for Efficient EDA With Manhattan Distance Decay

    May 11, 2026Zetao YangEfficient Neural Network InferenceReward Shaping

  9. PiCA: Pivot-Based Credit Assignment for Search Agentic Reinforcement Learning

    May 10, 2026Dongyi Liu, Yifan Niu, Qinwen Wang +2Reinforcement LearningReward Shaping

  10. OracleTSC: Oracle-Informed Reward Hurdle and Uncertainty Regularization for Traffic Signal Control

    May 8, 2026Darryl Jacob, Xinyu Liu, Muchao Ye +2Reward ShapingLanguage Model-Based Control

  11. ExpThink: Experience-Guided Reinforcement Learning for Adaptive Chain-of-Thought Compression

    May 8, 2026Tingcheng Bian, Yuzhe Zhang, Jing Jin +5Reward ShapingRL for Language Model Reasoning

  12. Signal Reshaping for GRPO in Weak-Feedback Agentic Code Repair

    May 8, 2026Jia Li, Yuxin Su, Ting Peng +3RL for Code GenerationReward Shaping

  13. Reward Shaping and Action Masking for Compositional Tasks using Behavior Trees and LLMs

    May 7, 2026Nicholas Potteiger, Ankita Samaddar, Taylor T. Johnson +1Reinforcement LearningReward Shaping

  14. Knowledge-Graph Paths as Intermediate Supervision for Self-Evolving Search Agents

    May 7, 2026Huyu Wu, Jun Liu, Xiaochi Wei +3Multi-Hop QAReward Shaping

  15. Self-Induced Outcome Potential: Turn-Level Credit Assignment for Agents without Verifiers

    May 6, 2026Senkang Hu, Yong Dai, Xudong Han +4Agentic RLReinforcement Learning

  16. Joint Energy Management and Coordinated AIGC Workload Scheduling for Distributed Data Centers: A Diffusion-Aided Reward Shaping Approach

    May 3, 2026Yang Fu, Peng Qin, Liming Chen +3Reward ShapingCost-Aware Inference

  17. EXPO-SQL: Execution-based Clause-level Policy Optimization for Text-to-SQL

    Apr 29, 2026Jaehoon Lee, CheolWon Na, Suyoung Bae +4Reward ShapingText-to-SQL

  18. Zero Shot Coordination for Sparse Reward Tasks with Diverse Reward Shapings

    Apr 28, 2026Keenan Powell, Peihong Yu, Pratap TokekarMulti-Agent CoordinationReward Shaping

  19. Occupancy Reward Shaping: Improving Credit Assignment for Offline Goal-Conditioned Reinforcement Learning

    Apr 22, 2026Aravind Venugopal, Jiayu Chen, Xudong Wu +3Reward ShapingTemporal Credit Assignment

  20. DR-MMSearchAgent: Deepening Reasoning in Multimodal Search Agents

    Apr 21, 2026Shengqin Wang, Wentao Yan, Huichi Zhou +4Reward ShapingRL for Language Model Reasoning

  21. OGER: A Robust Offline-Guided Exploration Reward for Hybrid Reinforcement Learning

    Apr 20, 2026Xinyu Ma, Mingzhou Xu, Xuebo Liu +4Reward ShapingRL for Language Model Reasoning

  22. Fuzzy Logic Theory-based Adaptive Reward Shaping for Robust Reinforcement Learning (FARS)

    Apr 17, 2026Hürkan Şahin, Van Huyen Dang, Erdi Sayar +2Reward ShapingRobotic RL

  23. TaoSR-AGRL: Adaptive Guided Reinforcement Learning Framework for E-commerce Search Relevance

    Oct 9, 2025Jianhui Yang, Yiming Jin, Pengkun Jiao +6RL for Language ModelsReward Shaping

  24. A Graph-Based Reinforcement Learning Approach with Frontier Potential Based Reward for Safe Cluttered Environment Exploration

    Apr 16, 2025Gabriele Calzolari, Vidya Sumathy, Christoforos Kanellakis +1Reward ShapingMobile Robotics

  25. Leader Reward for POMO-Based Neural Combinatorial Optimization

    May 22, 2024Chaoyang Wang, Pengzhi Cheng, Jingze Li +1Traveling Salesperson ProblemReward Shaping