Curriculum RL

RL: Reinforcement Learning

Momentum

11 papers in the last four weeks, up 83% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 61

All topics
CardsList
  1. EvoCUA-1.5: Online Reinforcement Learning for Multi-turn Computer-Use Agents

    Jul 7, 2026Mianqiu Huang, Taofeng Xue, Chong Peng +12RL for GUI AgentsPartially Observable RL

  2. LLM-as-a-Tutor: Policy-Aware Prompt Adaptation for Non-Verifiable RL

    Jul 5, 2026Yujin Kim, Namgyu Ho, Sangmin Hwang +7RL for Language ModelsReinforcement Learning

  3. Transferability for General Reasoning: An Automated Curriculum for Multi-Domain RLVR

    Jun 23, 2026Yongjin Yang, Jiarui Liu, Yinghui He +3RL for Language Model ReasoningCurriculum RL

  4. Curvature-Adaptive Consistency Flow Matching: Autonomous Trajectory Optimization via Reinforcement Learning

    Jun 21, 2026Songtao Tian, Guhan Chen, Bohan Li +2Curriculum RLFew-Step Diffusion Sampling

  5. Curriculum Reinforcement Learning Can Incentivize Reasoning Capacity in LLMs Beyond the Base Model

    Jun 21, 2026Pengxiang Cai, Tianchen Fang, Xiaohan Li +3RL for Language Model ReasoningCurriculum RL

  6. Learning at the Right Pace: Adaptive Data Scheduling Improves LLM Reinforcement Learning

    Jun 21, 2026Zicheng Xu, Ruixuan Zhang, Yu-Neng Chuang +7Reinforcement LearningRL for Language Model Reasoning

  7. From Attacks to Curricula: Learnability-Guided Adversarial Training for Safe Autonomous Driving

    Jun 12, 2026Yuewen Mei, Tong Nie, Jie Sun +3Adversarial TrainingAutonomous Driving

  8. Hey Chat, Can You Teach Me? Structuring Socratic Dialogue for Human Learning in the Wild

    Jun 10, 2026Sidney Tio, Arunesh Sinha, Pradeep VarakanthamIntelligent Tutoring SystemsAI in Education

  9. RoboNaldo: Accurate, Stable and Powerful Humanoid Soccer Shooting via Motion-Guided Curriculum Reinforcement Learning

    Jun 9, 2026Yichao Zhong, Yidan Lu, Yuhang Lu +9Reinforcement LearningRobot Skill Learning

  10. Self-Paced Curriculum Reinforcement Learning for Autonomous Superbike Racing in Simulation

    Jun 8, 2026Luca Ghisi, Jacopo Essenziale, Carlo D'Eramo +1Curriculum RLAutonomous Racing

  11. HORIZON: Recoverability-Governed Curriculum for Physical-Domain Scaling

    Jun 3, 2026Chenhao Bai, Liqin Lu, Kaijun Wang +5Domain RandomizationCurriculum RL

  12. GUI-C2^2: Coarse-to-Fine GUI Grounding via Difficulty-Aware Reinforcement Learning

    May 29, 2026Junlong Li, Chao Hao, Lap-Pui Chau +1Multimodal GroundingAgentic RL

  13. Restoring the Sweet Spot: Pass-Rate Weighted Self-Distillation for LLM Reasoning

    May 26, 2026Zehao Liu, Yuanpu Cao, Jinghui Chen +1Reinforcement LearningOn-Policy Self-Distillation

  14. Evolutionary Enhanced Multi-Agent Reinforcement Learning for Cooperative Air Combat

    May 24, 2026Chengwei Li, Junlin Liu, Yang GaoMulti-Agent CoordinationReinforcement Learning

  15. Curriculum reinforcement learning with measurable task representation learning

    May 22, 2026Yongyan Wen, Siyuan Li, Mingjian Fu +3Representation LearningCurriculum RL

  16. What Training Data Teaches RL Memory Agents: An Empirical Study of Curriculum Effects in Memory-Augmented QA

    May 21, 2026Xinjie He, Zhiyuan Lin, Su Liu +4Memory-Augmented Neural NetworksCurriculum RL

  17. From Reasoning Chains to Verifiable Subproblems: Curriculum Reinforcement Learning Enables Credit Assignment for LLM Reasoning

    May 21, 2026Xitai Jiang, Zihan Tang, Wenze Lin +3RL for Language Model ReasoningCredit Assignment in RL

  18. Curriculum Group Policy Optimization: Adaptive Sampling for Unleashing the Potential of Text-to-Image Generation

    May 18, 2026Baoteng Li, Xianghao Zang, Xinran Wang +8Group Relative Policy OptimizationCurriculum RL

  19. D2^2Evo: Dual Difficulty-Aware Self-Evolution for Data-Efficient Reinforcement Learning

    May 16, 2026Ru Zhang, Renda Li, Ziyu Ma +4RL for Language Model ReasoningCurriculum RL

  20. CuSearch: Curriculum Rollout Sampling via Search Depth for Agentic RAG

    May 12, 2026Jianghan Shen, Siqi Luo, Xinyu Cheng +6RL for Language ModelsReinforcement Learning

  21. Internalizing Curriculum Judgment for LLM Reinforcement Fine-Tuning

    May 11, 2026Han Zheng, Yining Ma, Karthick Gunasekaran +4Reinforcement LearningMeta-Learning

  22. Schedule-and-Calibrate: Utility-Guided Multi-Task Reinforcement Learning for Code LLMs

    May 7, 2026Yujia Chen, Yang Ye, Xiao Chu +2RL for Code GenerationReinforcement Learning

  23. Selector-Guided Autonomous Curriculum for One-Shot Reinforcement Learning from Verifiable Rewards

    May 3, 2026Rudray Dave, Vedang Dubey, Smit Deoghare +1Reinforcement LearningRL for Language Model Reasoning

  24. Wiki-R1: Incentivizing Multimodal Reasoning for Knowledge-based VQA via Data and Sampling Curriculum

    Mar 5, 2026Shan Ning, Longtian Qiu, Xuming HeVisual Question AnsweringReinforcement Learning

  25. Teaching Models to Teach Themselves: Reasoning at the Edge of Learnability

    Jan 26, 2026Shobhita Sundaram, John Quan, Ariel Kwiatkowski +3Self-Play RLRL for Language Model Reasoning