Agentic RL

RL: Reinforcement Learning

Momentum

28 papers in the last four weeks, up 300% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 140

All topics
CardsList
  1. CityPlanner: A Sandbox Agent for Executable Urban Planning

    Sep 10, 2026Wentao Zhang, Jingyuan Wang, Zetong Zhou +2Agentic RLUrban Planning

  2. Elastic Horizon: Discovering the Effective Interaction Frontier in Agentic Reinforcement Learning

    Sep 7, 2026Gangyi Zhang, Junjie Meng, Letian Zhang +6Agentic RLCurriculum RL

  3. DRACO: Fine-Grained Credit Assignment with Dynamic Rubrics for Long-Horizon Agent Training

    Sep 3, 2026Shubham Gandhi, Saurabh Goyal, Kiran Kate +1Agentic RLStep-Level Credit Assignment in RL

  4. RTPO: Reverse-Turn Policy Optimization for Stabilizing Agentic RL Training

    Aug 19, 2026Yugu Li, Zehong Cao, Jianglin Qiao +1Agentic RLReinforcement Learning

  5. TideRL: Boosting Agentic RL Goodput with Readiness-Aware Scheduling

    Aug 11, 2026Yanyu Ren, Xizheng Wang, Xiao Liu +8Agentic RLAsynchronous RL

  6. Learning from Environmental Feedback: Credit Assignment across Multiple Timescales for Agentic Reinforcement Learning

    Aug 8, 2026Yifu Huo, Shunjie Xing, Chenglong Wang +8Agentic RLCredit Assignment in RL

  7. Trajectory-Relative Hindsight Distillation for Agentic Reinforcement Learning

    Aug 7, 2026Haoyu Zheng, Yun Zhu, Qing Wang +1Agentic RLCredit Assignment in RL

  8. EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning

    Aug 6, 2026Zishan Xu, Zhiyuan Yao, Yuxin Chen +9LLM World ModelsAgentic RL

  9. iARCS: Iterative Agentic RL for Controllable 3D Scene Generation

    Aug 6, 2026Saugat Adhikari, Ashok Prasad Neupane, Pramish Paudel +2Constrained Generative ModelingAgentic RL

  10. AgentOPSD: Recursive Self-Distillation for Agentic Reinforcement Learning

    Aug 6, 2026Zi-Han Wang, Zhengxi Lu, Zhiyuan Yao +10Agentic RLReinforcement Learning

  11. Agentic Reinforcement Learning with Observation-Calibrated Self-Distillation

    Aug 5, 2026Yi Yang, Cong Qin, Xiaodan Liu +8Agentic RLOn-Policy Distillation

  12. Group-Reflective Self-Distillation for Agentic Reinforcement Learning

    Jul 30, 2026Binbin Zheng, Zijun Xie, Guanqun Zhao +4Agentic RLCredit Assignment in RL

  13. SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution

    Jul 29, 2026Zhiyuan Yao, Yuxin Chen, Zhengxi Lu +13Agentic RLCurriculum RL

  14. Graph Is the Verifier: Agentic Reinforcement Learning for Interprocedural Vulnerability Detection

    Jul 29, 2026Yikun Li, Ting Zhang, Jiakun Liu +9Agentic RLSoftware Vulnerability Detection

  15. AgentOmnia: Scaling Agentic Models for Full-Scenario Applications

    Jul 25, 2026Hao Jiang, Gangtao Xin, Yingdi Huang +35Tool-Augmented Language Model AgentsAgentic RL

  16. AREX: Towards a Recursively Self-Improving Agent for Deep Research

    Jul 23, 2026Shuqi Lu, Chaofan Li, Kun Luo +21Agentic RLDeep Research Agents

  17. PATS: Policy-Aware Training Scaffolding for Agentic Reinforcement Learning

    Jul 23, 2026Yipeng Shi, Zhipeng Ma, Yue Wang +4Agentic RLLLM Agent Skill Learning

  18. EmoAgent-R1: Towards Multimodal Emotion Understanding with Reinforcement Learning-based Dynamic Agent Specialization

    Jul 23, 2026Lihuang Fang, Yuchen Zou, kebing Jin +1RL for Language ModelsAgentic RL

  19. When Does Muon Help Agentic Reinforcement Learning?

    Jul 17, 2026Kai Ruan, Jinghao Lin, Zihe Huang +4Agentic RLMuon Optimizer

  20. ToolVerse: Unlocking Massive Environments and Long-Horizon Tasks for Agentic Reinforcement Learning

    Jul 17, 2026Shuaiyu Zhou, Fengpeng Yue, Zengjie Hu +5Tool-Use EvaluationAgentic RL

  21. SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement Learning

    Jul 16, 2026Jinyang Wu, Shuo Yang, Zhengxi Lu +8Agentic RLOn-Policy Distillation