LLM Agent Training

LLM: Large Language Model

Latest papers 354

All topics
CardsList
  1. From History to State: Constant-Context Skill Learning for LLM Agents

    May 6, 2026Haoyang Xie, Xinyuan Wang, Yancheng Wang +2LLM Agent Skill LearningLLM Agent Training

  2. SciResearcher: Scaling Deep Research Agents for Frontier Scientific Reasoning

    May 2, 2026Tianshi Zheng, Rui Wang, Xiyun Li +5AI for ScienceDeep Research Agents

  3. MAD-OPD: Breaking the Ceiling in On-Policy Distillation via Multi-Agent Debate

    May 2, 2026Jianze Wang, Ying Liu, Jinlong Chen +7Multi-Agent DebateMulti-Teacher Knowledge Distillation

  4. AutoSurfer -- Teaching Web Agents through Comprehensive Surfing, Learning, and Modeling

    Apr 29, 2026Fazle Elahi Faisal, Qianhui Wu, Baolin Peng +1LLM Agent TrainingWeb Agents

  5. ClawGym: A Scalable Framework for Building Effective Claw Agents

    Apr 29, 2026Fei Bai, Huatong Song, Shuang Sun +11Synthetic Data GenerationAI Agent Benchmarks

  6. Recursive Multi-Agent Systems

    Apr 28, 2026Jiaru Zou, Rui Pan, Ruizhong Qiu +8Multi-Agent LLM SystemsLanguage Modeling

  7. Toward Scalable Terminal Task Synthesis via Skill Graphs

    Apr 28, 2026Zhiyuan Fan, Tinghao Yu, Yuanjun Cai +8Terminal AgentsLLM Agent Trajectory Synthesis

  8. DPEPO: Diverse Parallel Exploration Policy Optimization for LLM-based Agents

    Apr 27, 2026Junshuo Zhang, Chengrui Huang, Feng Guo +6Reinforcement LearningRL Exploration

  9. Poster: ClawdGo: Endogenous Security Awareness Training for Autonomous AI Agents

    Apr 27, 2026Jiaqi Li, Yang Zhao, Bin Sun +3AI Agent SecurityLLM Agent Training

  10. Nemobot Games: Crafting Strategic AI Gaming Agents for Interactive Learning with Large Language Models

    Apr 23, 2026Chee Wei Tan, Yuchen Wang, Shangxin GuoGame-Playing AgentsLLM Agents

  11. Learning to Communicate: Toward End-to-End Optimization of Multi-Agent Language Systems

    Apr 23, 2026Ye Yu, Heming Liu, Haibo Jin +3Multi-Agent System OptimizationLLM Agent Training

  12. Supplement Generation Training for Enhancing Agentic Task Performance

    Apr 22, 2026Young Min Cho, Daniele Bonadiman, Divya Bhargavi +8LLM Agent TrainingPrompt Optimization

  13. Training and Agentic Inference Strategies for LLM-based Manim Animation Generation

    Apr 20, 2026Ravidu Suien Rammuni Silva, Ahmad Lotfi, Isibor Kennedy Ihianle +2RL for Code GenerationText-to-Video Generation

  14. ComPASS: Towards Personalized Agentic Social Support via Tool-Augmented Companionship

    Apr 20, 2026Zhaopei Huang, Yanfeng Jia, Jiayi Zhao +3AI CompanionsAI Agent Benchmarks

  15. Agent-World: Scaling Real-World Environment Synthesis for Evolving General Agent Intelligence

    Apr 20, 2026Guanting Dong, Junting Lu, Junjie Huang +17Lifelong Learning AgentsAI Agent Benchmarks

  16. Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration

    Apr 20, 2026Qifan Zhang, Dongyang Ma, Tianqing Fang +5Intrinsic MotivationLLM Agent Self-Improvement

  17. AIT Academy: Cultivating the Complete Agent with a Confucian Three-Domain Curriculum

    Apr 20, 2026Jiaqi Li, Lvyang Zhang, Yang Zhao +2LLM Agent Skill LearningCurriculum Learning

  18. LiteResearcher: A Scalable Agentic RL Training Framework for Deep Research Agent

    Apr 20, 2026Wanli Li, Bince Qu, Bo Pan +5Agentic RLDeep Research Agents

  19. Democratizing Tool Learning with Environments Fully Simulated by a Free 8B Language Model

    Apr 20, 2026Chenming Tang, Hsiu-Yuan Huang, Weijie Liu +3LLM Agent TrainingRL for Tool Use

  20. Small Model as Master Orchestrator: Learning Unified Agent-Tool Orchestration with Parallel Subtask Decomposition

    Apr 18, 2026Wenzhen Yuan, Wutao Xiong, Fanchen Yu +7Multi-Agent System OptimizationMulti-Agent Orchestration

  21. AgentV-RL: Scaling Reward Modeling with Agentic Verifier

    Apr 17, 2026Jiazheng Zhang, Ziche Fu, Zhiheng Xi +13Reward ModelingRL for Language Model Reasoning

  22. CoEvolve: Training LLM Agents via Agent-Data Mutual Evolution

    Apr 17, 2026Shidong Yang, Ziyu Ma, Tongwen Huang +3LLM Agent TrainingRL for LLM Agents

  23. SAT: Sequential Agent Tuning for Coordinator Free Plug and Play Multi-LLM Training with Monotonic Improvement Guarantees

    Apr 17, 2026Yi Xie, Yangyang Xu, Yi Fan +1LLM Agent TrainingDecentralized MARL

  24. Subliminal Transfer of Unsafe Behaviors in AI Agent Distillation

    Apr 16, 2026Jacob Dang, Brian Y. Xie, Omar G. YounisSubliminal LearningLanguage Model Distillation