LLM Agent Training

LLM: Large Language Model

Latest papers 354

All topics
CardsList
  1. EnvACE: Internalizing Environment Dynamics via World Rehearsal for Agentic Reinforcement Learning

    Aug 6, 2026Zishan Xu, Zhiyuan Yao, Yuxin Chen +9LLM World ModelsAgentic RL

  2. StepReflect: Structured UI Transition Reflection for Mobile GUI Agents

    Aug 6, 2026Linqiang Guo, Wei Liu, Li Gu +3Mobile GUI AutomationGUI Agents

  3. Recursive Synthesis for Long-Horizon Terminal Tasks

    Aug 5, 2026Zhongzhi Li, Yucheng Shi, Zongxia Li +8Terminal AgentsSynthetic Benchmark Generation

  4. State2State: Environment-Derived Mid-Training for LLM Agents

    Aug 5, 2026Xuanyu Lei, Yiqi Zhu, Chenliang Li +6LLM Agent TrainingGoal-Conditioned RL

  5. A-SR: Self-Evolving Agentic LLMs for Symbolic Regression via Hierarchical Coordination

    Aug 5, 2026Wenxiao Zhao, Dong Liu, Kaiyi Xu +9Multi-Agent LLM SystemsLLM Agent Training

  6. Look Ahead Before You Distill: Future Trajectory Validation of Teacher Guidance for Agentic On-Policy Distillation

    Aug 3, 2026Chishui Chen, Yaoyou Fan, Te Sun +11LLM Agent TrainingOn-Policy Distillation

  7. CRISP: Critical Step Perception for Training Efficient Deep Search Agents

    Aug 3, 2026Haosi Mo, Zihao Yan, Ruiqing Zhang +4LLM AgentsLLM Agent Training

  8. SearchMaster: Grounded and Regulated Self-Play for Search Agents

    Aug 3, 2026Wentao Tan, Qiong Cao, Jiaqi Wang +1Multi-Hop QATool-Augmented Language Model Agents

  9. SyncPlan: Long-Horizon LLM Coordination with Explicit Synchronization and Adaptive Correction

    Aug 3, 2026Shen You, Xiaoming Zhu, Weining Weng +17Multi-Agent CoordinationLLM Planning

  10. Search-GRT: Guided Retrieval Training of Search Agents to Optimize for Complex Question Answering

    Aug 2, 2026Aounon Kumar, Sudipta Paul, Vivek Kulkarni +2Multi-Hop QAAgentic RAG

  11. Deep Research Pretraining via Predictive Navigation

    Aug 1, 2026Jiang Zhou, Zhiyuan Fan, Xing Wu +3Deep Research AgentsLLM Agent Training

  12. Learning to Coordinate Symbolic Tools: LLM Agents for Verified Sum-of-Squares Certificates

    Jul 31, 2026Bohan Chen, Shivam N. Patel, Richard Hoffmann +2LLM Agent VerificationTool-Using Agents

  13. MAGA: Multi-Platform Self-Fusion of GUI Agents via Structured Action Distillation

    Jul 31, 2026Hang Yan, Zhangxuan GU, Beitong Zhou +5Multi-Teacher Knowledge DistillationLLM Agent Training

  14. Qwen-UI-Agent Technical Report: Toward Next-Generation Real-World Centric Foundation GUI Agents

    Jul 30, 2026Hanzhang Zhou, Panrong Tong, Xu Zhang +13Mobile GUI AutomationComputer-Use Agents

  15. Echoverse: Deep, Evolving Environments for Training Computer-Use Agents at Scale

    Jul 30, 2026Yash Pandya, Sahil Gupta, Sarthak Harne +10Computer-Use Agent BenchmarksComputer-Use Agents

  16. SKILL-KD: Contrastive Skill Distillation for LLM Agents

    Jul 30, 2026Qiming Shi, Yibo Dou, Jiawen Zhu +5LLM Agent Skill LearningLLM Agent Training

  17. Meta-Task: Turning Terminal Task Synthesis into a Terminal Task for Scalable Agent Training

    Jul 30, 2026Zhihong Pan, Jiyuan He, Kai Zhang +5Synthetic Data GenerationTerminal Agents

  18. MindForge: Teaching Small Language Models Whole-Life-Cycle Software Engineering via Source-Free Program Synthesis

    Jul 29, 2026Yihao Chen, Shi Chang, Khaled Chawa +4Program SynthesisAutomated Software Engineering

  19. WikiLoop: Jointly Learning to Build and Navigate Agent-Native Wikis with Downstream Feedback

    Jul 29, 2026Haoliang Ming, Feifei Li, Wenhui QueMulti-Hop QAKG Construction

  20. Speculate While You Reason: Teaching Agents to Predict Their Next Tool Call via Joint Agent-Speculator RL

    Jul 28, 2026Jiabao Ji, Yujian Liu, Li An +4Tool-Using AgentsLLM Agent Training

  21. Matryoshka Agent: Unfolding Sub-Agents for Long-Horizon Machine Learning Engineering

    Jul 27, 2026Rushi Qiang, Changhao Li, Haotian Sun +3LLM Agent OrchestrationLLM Agents

  22. ACM: Agentic Context Management for Long Horizon Tasks

    Jul 26, 2026Xiaochuan Li, Ryan Ming, Meng Chu +3LLM Agent TrainingLong-Horizon Agent Tasks

  23. AgentOmnia: Scaling Agentic Models for Full-Scenario Applications

    Jul 25, 2026Hao Jiang, Gangtao Xin, Yingdi Huang +35Tool-Augmented Language Model AgentsAgentic RL