Agentic RL

RL: Reinforcement Learning

Momentum

28 papers in the last four weeks, up 300% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 140

All topics
CardsList
  1. Self-Induced Outcome Potential: Turn-Level Credit Assignment for Agents without Verifiers

    May 6, 2026Senkang Hu, Yong Dai, Xudong Han +4Agentic RLReinforcement Learning

  2. T2^2PO: Uncertainty-Guided Exploration Control for Stable Multi-Turn Agentic Reinforcement Learning

    May 4, 2026Haixin Wang, Hejie Cui, Chenwei Zhang +7Agentic RLReinforcement Learning

  3. AEM: Adaptive Entropy Modulation for Multi-Turn Agentic Reinforcement Learning

    May 1, 2026Haotian Zhao, Songlin Zhou, Yuxin Zhang +9Agentic RLCredit Assignment in RL

  4. Rethinking Agentic Reinforcement Learning In Large Language Models

    Apr 30, 2026Fangming Cui, Ruixiao Zhu, Cheng Fang +2RL for Language ModelsAgentic RL

  5. FutureWorld: A Live Reinforcement Learning Environment for Predictive Agents with Real-World Outcome Rewards

    Apr 29, 2026Zhixin Han, Yanzhi Zhang, Chuyang Wei +11Agentic RLReinforcement Learning

  6. StepPO: Step-Aligned Policy Optimization for Agentic Reinforcement Learning

    Apr 20, 2026Daoyu Wang, Qingchuan Li, Mingyue Cheng +4Agentic RLCredit Assignment in RL

  7. LiteResearcher: A Scalable Agentic RL Training Framework for Deep Research Agent

    Apr 20, 2026Wanli Li, Bince Qu, Bo Pan +5Agentic RLDeep Research Agents

  8. TrafficClaw: A Generalizable LLM Agent in the Unified Physical Environment for Urban Traffic Control

    Apr 19, 2026Siqi Lai, Pan Zhang, Yuping Zhou +3Agentic RLLanguage Model-Based Control

  9. ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning

    Feb 25, 2026Xiaoxuan Wang, Han Zhang, Haixin Wang +11Agentic RLReinforcement Learning

  10. Pushing Forward Pareto Frontiers of Proactive Agents with Behavioral Agentic Optimization

    Feb 11, 2026Yihang Yao, Zhepeng Cen, Haohong Lin +6Agentic RLLLM Agents

  11. CLEANER: Self-Purified Trajectories Boost Agentic Reinforcement Learning

    Jan 21, 2026Tianshi Xu, Yuteng Chen, Meng LiAgentic RLReinforcement Learning

  12. PaperScout: An Autonomous Agent for Academic Paper Search with Process-Aware Sequence-Level Policy Optimization

    Jan 15, 2026Tingyue Pan, Jie Ouyang, Mingyue Cheng +7Agentic RLPolicy Optimization

  13. OpenTinker: Separating Concerns in Agentic Reinforcement Learning

    Jan 12, 2026Siqi Zhu, Jiaxuan YouAgentic RLLLM Agent Training

  14. LLM-Empowered Agentic MAC Protocols: A Dynamic Stackelberg Game Approach

    Oct 13, 2025Renxuan Tan, Rongpeng Li, Fei Wang +4Agentic RLStackelberg Games

  15. DeepTravel: An End-to-End Agentic Reinforcement Learning Framework for Autonomous Travel Planning Agents

    Sep 26, 2025Yansong Ning, Rui Liu, Jun Wang +6Agentic RLLLM Agent Training

  16. AgentFly: Scaling Agentic Reinforcement Learning with Unified Resource System

    Jul 20, 2025Renxi Wang, Rifo Ahmad Genadi, Bilal El Bouardi +5Agentic RLLLM Agent Training

  17. Agentic Episodic Control

    Jun 2, 2025Xidong Yang, Wenhao Li, Junjie Sheng +4Agentic RLReinforcement Learning