Intrinsic Reward Methods

Momentum

4 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 19

All topics
CardsList
  1. When Do Intrinsic Rewards Lead to Exploration?

    Oct 1, 2026Scott W. Viteri, Laura Gomezjurado Gonzalez, Clark BarrettIntrinsic Reward MethodsRL Exploration

  2. Belief-Based Maximum Occupancy Principle and Active Inference

    Sep 30, 2026Manolis Mylonas, Rubén Moreno BoteBelief-Space PlanningIntrinsic Reward Methods

  3. Intrinsic Robot Rewarding: Reusing VLA Representations for Autonomous Evaluation and Policy Improvement

    Sep 15, 2026Tobias Schaffer, Mohab Elkhayat, Daniela Nicklas +2RL for RoboticsIntrinsic Reward Methods

  4. Efficient Exploration Is Enough

    Sep 7, 2026Mikel Malagón, Jon Vadillo, Josu Ceberio +2Intrinsic Reward MethodsRL Exploration

  5. PAST: Prompt-Adaptive Sampling Termination for Efficient Diffusion Model

    Aug 7, 2026Renye Yan, Jikang Cheng, You Wu +4Intrinsic Reward MethodsReinforcement Learning

  6. Search-G1: Grounded Search Agents via Representation-Based Intrinsic Rewards

    Jul 24, 2026Cheng Ruoxi, Ma Haoxuan, Zhang Hongyi +7Retrieval-Augmented GenerationLLM Grounding

  7. Principled Direction-Free Intrinsic Motivation through Model-Free Epistemic Free-Energy Estimators

    Jul 18, 2026Alireza Furutanpey, Schahram DustdarFree Energy CalculationIntrinsic Reward Methods

  8. Trust Your Instincts: Confidence-Driven Test-Time RL for Vision-Language-Action Models

    Jun 29, 2026Siyao Chen, Jiakang Yuan, Jiaxin Wang +1Intrinsic Reward MethodsReinforcement Learning

  9. OPERA: Aligning Open-Ended Reasoning via Objective Perplexity-based Reinforcement Learning

    Jun 24, 2026Wenxuan Jiang, Zining Fan, Zijian Zhang +6Open-Ended GenerationIntrinsic Reward Methods

  10. When Do Intrinsic Rewards Work for Code Reasoning? A Comprehensive Study

    Jun 18, 2026Xiaolong Jin, Xuandong Zhao, Wenbo Guo +2RL for Code GenerationIntrinsic Reward Methods

  11. Can In-Context Learning Support Intrinsic Curiosity?

    Jun 17, 2026Eric Elmoznino, Sangnie Bhardwaj, Johannes von Oswald +5Intrinsic Reward MethodsIntrinsic Motivation

  12. Momentum for Reasoning: Dense Intrinsic Signals in Policy Optimization

    Jun 7, 2026Hao Chen, Zhanming Shen, Liyao Li +8Intrinsic Reward MethodsReinforcement Learning

  13. Two is better than one: A Collapse-free Multi-Reward RLIF Training Framework

    May 21, 2026Shourov Joarder, Diganta Sikdar, Ahsan Habib Akash +2Multi-Objective Reinforcement LearningIntrinsic Reward Methods

  14. CIG: Exploration via Conditional Information Gain

    May 20, 2026Tim Joseph, Marcus Fechner, Philipp Stegmaier +2Intrinsic Reward MethodsIntrinsic Motivation

  15. Verifier-Free RL for LLMs via Intrinsic Gradient-Norm Reward

    May 11, 2026Xuexiang Wen, Hang Yu, Linchao Zhu +1Intrinsic Reward MethodsReinforcement Learning

  16. Quality-Aware Exploration Budget Allocation for Cooperative Multi-Agent Reinforcement Learning

    May 3, 2026Dahyun Oh, Minhyuk Yoon, H. Jin KimMulti-Agent CoordinationIntrinsic Reward Methods

  17. MAGIC: Multi-Step Advantage-Gated Causal Influence for Multi-agent Reinforcement Learning

    May 3, 2026Haohan Yu, Jinmiao Cong, Shengzhi Wang +2Multi-Agent CoordinationIntrinsic Reward Methods

  18. Curiosity-Critic: Cumulative Prediction Error Improvement as a Tractable Intrinsic Reward for World Model Training

    Apr 20, 2026Vin Bhaskara, Haicheng WangIntrinsic Reward MethodsReinforcement Learning

  19. ELEMENT: Episodic and Lifelong Exploration via Maximum Entropy

    Dec 5, 2024Hongming Li, Zhao Yang, Xiaoxuan Liang +2Intrinsic Reward MethodsReinforcement Learning