Curriculum RL

RL: Reinforcement Learning

Momentum

11 papers in the last four weeks, up 83% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 61

All topics
CardsList
  1. Self-Evolve With a Reference:Anchored Training of Tool-Integrated Agents

    Oct 7, 2026Wenjie Liao, Liangjie Zhao, Zehong CaoLLM Agent Self-ImprovementSelf-Evolving Agents

  2. Predictive Safety Curricula for Robust Legged Locomotion

    Sep 29, 2026Ivan Ovinnikov, Pascal Sutter, Christian Gehring +1Curriculum RLRobot Safety

  3. ARISE: Adapting to Evolving Capability Gaps in Agentic Reinforcement Learning

    Sep 28, 2026Kun Feng, Yuchen Fang, Yiyang Tan +6Agentic RLLong-Horizon Agent Evaluation

  4. Climbing the Hill: Prompt Injection Red-Teaming Against Frontier Models with Curriculum Reinforcement Learning

    Sep 27, 2026Chenlong Yin, Xiaolong Jin, Wei Zou +2Adversarial Attacks on LLMsLLM Red Teaming

  5. Adversarial Closed-Loop Curriculum for Evolving Role-Playing Agents

    Sep 23, 2026Zheng Zhang, Liu Liu, Qi Chai +4Large Language Model-Based Role-Play SimulationAdversarial Scenario Generation

  6. Curriculum Learning with GNN-based Reinforcement Learning for Job Shop Scheduling

    Sep 23, 2026Jayakrishnan K. Vasudevan, Jonathan Hoss, Noah KlarmannReinforcement LearningCurriculum RL

  7. MATCH: Model-Aware Tool Learning with Curriculum Scheduling and Hierarchically Gated Rewards

    Sep 17, 2026Shihao Liu, Hao Yin, Lijun Liu +3Reward ModelingCurriculum RL

  8. DeliveryGym: An RL Environment for Long-Horizon Embodied Agent Planning with Adaptive Curriculum

    Sep 17, 2026Haoqiang Kang, Yiming Zhang, Yiyang Guo +5Long-Horizon PlanningLong-Horizon Agent Evaluation

  9. Not All Prompts Are Equal: Exploration-Guided Prompt Scaffolding for Multimodal Reinforcement Post-Training

    Sep 14, 2026Yuanhao Yue, Qianli Ma, Chengyu Wang +3Multimodal Large Language ModelsCurriculum RL

  10. Actuator Dynamics Curricula for Narrow-Viability Tasks in Legged Robot Learning

    Sep 8, 2026Kousheek Chakraborty, Chandan K. Rajendra, Ayham Alharbat +1Curriculum RLRL for Legged Locomotion

  11. Elastic Horizon: Discovering the Effective Interaction Frontier in Agentic Reinforcement Learning

    Sep 7, 2026Gangyi Zhang, Junjie Meng, Letian Zhang +6Agentic RLCurriculum RL

  12. Environment Evolution for Terminal Agents

    Sep 3, 2026Zhiyuan Fan, Tinghao Yu, Yuanjun Cai +9Terminal AgentsCurriculum RL

  13. Scaling Large Reasoning Models beyond Human Supervision: A Path toward Superintelligence

    Aug 31, 2026Zhiqin Yang, Jingwen Fu, Yuhan Liu +16Reinforcement LearningRL for Language Model Reasoning

  14. Beyond Uncertainty: Multi-Solver Disagreement Rewards for Self-Evolving Reasoning Curricula

    Aug 30, 2026Vinoth Selvendran, Zhanming ZhangReward ModelingRL for Language Model Reasoning

  15. CVPO: Enhancing LLM Reinforcement Learning Reasoning via Value-Variance Adaptation and Dynamic Curriculum Learning

    Aug 4, 2026Ziqi Jia, Yalu Ouyang, Bo Pang +5Numerical Reasoning in Language ModelsRL for Language Model Reasoning

  16. Question Begets Question: Self-Evolving Curriculum for Reinforcement Fine-Tuning on Competition Mathematics

    Aug 2, 2026Longtian Bao, Jianyou Wang, Yang Zhang +2Synthetic Data GenerationCurriculum RL

  17. Kalman Meets Curriculum: Efficient Dynamic Prompt Selection for Adaptive RL Finetuning

    Jul 30, 2026Haodong Zhu, Yangyang Ren, Yanjing Li +4RL for Language Model ReasoningCurriculum RL

  18. SkillRise: Agentic Reinforcement Learning for Cross-Task Skill Evolution

    Jul 29, 2026Zhiyuan Yao, Yuxin Chen, Zhengxi Lu +13Agentic RLCurriculum RL

  19. SCOUT: Per-Context Reset Curricula for Sparse-Reward Reinforcement Learning

    Jul 29, 2026Siddharth Aphale, Ayushman SinghCurriculum RLCurriculum Learning

  20. WARL: Wrench-Augmented Reinforcement Learning for Task-Agnostic Learning in Legged Robots

    Jul 27, 2026Keita Yoneda, Kento Kawaharazuka, Kei OkadaCurriculum RLRL Exploration

  21. Offline-Online Curriculum RL for Multimodal Reasoning

    Jul 26, 2026Wendi Deng, Hang Du, Guoshun Nan +11Reinforcement LearningRL for Language Model Reasoning

  22. Open-ended Multi-agent Autocurricula via Visual Inspection of Policies with Multi-modal LLMs

    Jul 9, 2026Lorenzo Pantè, Andrea Fanti, Roberto CapobiancoGame-Playing AgentsCurriculum RL