RL for LLM Agents

RL: Reinforcement Learning · LLM: Large Language Model

Momentum

70 papers in the last four weeks, up 141% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 402

All topics
CardsList
  1. Reasoning and Tool-use Compete in Agentic RL:From Quantifying Interference to Disentangled Tuning

    Feb 1, 2026Yu Li, Mingyang Yi, Xiuyu Li +6RL for Language Model ReasoningGradient Interference

  2. CLEANER: Self-Purified Trajectories Boost Agentic Reinforcement Learning

    Jan 21, 2026Tianshi Xu, Yuteng Chen, Meng LiAgentic RLReinforcement Learning

  3. PEARL: Self-Evolving Assistant for Time Management with Reinforcement Learning

    Jan 17, 2026Bingxuan Li, Jeonghwan Kim, Cheng Qian +4Long-Horizon Agent TasksRL for LLM Agents

  4. MemBuilder: Reinforcing LLMs for Long-Term Memory Construction via Attributed Dense Rewards

    Jan 9, 2026Zhiyu Shen, Ziming Wu, Fuming Lai +2Reinforcement LearningMemory-Augmented Language Models

  5. AdaSearch: Balancing Parametric Knowledge and Search in Large Language Models via Reinforcement Learning

    Dec 18, 2025Tzu-Han Lin, Wei-Lin Chen, Chen-An Li +3Retrieval-Augmented GenerationKnowledge Augmentation for Language Models

  6. Stabilizing Off-Policy Training for Long-Horizon LLM Agent via Turn-Level Importance Sampling and Clipping-Triggered Normalization

    Nov 25, 2025Chenliang Li, Adel Elmahdy, Alex Boyd +7RL for Language Model ReasoningImportance Sampling

  7. Why Do LLM Agents Fail in Exploring New Environments? A World-Modeling Perspective

    Oct 16, 2025Shiqi Chen, Tongyao Zhu, Zian Wang +8RL ExplorationPolicy Learning

  8. Dynamic Optimizations of LLM Ensembles with Two-Stage Reinforcement Learning Agents

    Feb 6, 2025Selim Furkan Tekin, Gaowen Liu, Ramana Rao Kompella +1Multi-Agent LLM SystemsLanguage Model Ensembles

  9. Clearing the Fog: Towards Installing and Refining Proactive Exploration Capabilities in LLM Agents

    Date pendingZhizhao Guan, Chen Huang, Ziming Liu +5RL ExplorationLLM Agents

  10. CoSkill: Joint Reinforcement Learning of Reasoning and Meta-Skill Agents for Hierarchical Skill Evolution

    Date pendingJinyuan Feng, Dongmin Li, Yiqun Chen +4Hierarchical RLLLM Agent Skill Learning