LLM Agent Training

LLM: Large Language Model

Latest papers 354

All topics
CardsList
  1. DynSess: Dynamic Session-Level Evaluation and Optimization Framework for Role-Playing Agents

    May 28, 2026Rongsheng Zhang, Jiji Tang, Junnan Ren +6Large Language Model-Based Role-Play SimulationLong-Horizon Agent Evaluation

  2. DocArena: Turning Raw Documents into Controllable Training Environments for Document Search Agents

    May 27, 2026Jiamian Wang, Ruiyi Zhang, Tong Yu +5Multimodal IRMultimodal QA

  3. Plan Before Search: Search Agents Need Plan

    May 27, 2026Zhipeng Qian, Zihan Liang, Yufei Ma +7Multi-Hop QATool-Augmented Language Model Agents

  4. Retrieval, Reward, and Training Protocols: What Matters in Training Search Agents?

    May 27, 2026Yibo Zhao, Zichen Ding, Jiayi Wu +2LLM AgentsInformation Retrieval

  5. Hierarchical Prompt-Domain Control and Learning for Resource-Constrained Agentic Language Models

    May 26, 2026Joan Vendrell Gallart, Russell Bent, Michael GrosskopfContinual Learning for LLM AgentsLanguage Model-Based Control

  6. You Only Align Once: Propagating Cooperative Behaviors in Multi-Agent Systems through Seed Agents

    May 26, 2026Nicole Hsing, Asuka Yuxi Zheng, Yi Zhao +2Social DilemmasAI Alignment

  7. Learning to Act under Noise: Enhancing Agent Robustness via Noisy Environments

    May 26, 2026Yuxin Chen, Xiaodong Cai, Junfeng Fang +9LLM AgentsLLM Agent Training

  8. Efficient Agentic Reinforcement Learning with On-Policy Intrinsic Knowledge Boundary Enhancement

    May 26, 2026Dingwei Chen, Zefang Zong, Zhipeng Ma +5Agentic RLLLM Agent Training

  9. UnityMAS-O: A General RL Optimization Framework for LLM-Based Multi-Agent Systems

    May 26, 2026Yiqun Chen, Wei Yang, Erhan Zhang +14Multi-Agent LLM SystemsMulti-Agent System Optimization

  10. CUA-Gym: Scaling Verifiable Training Environments and Tasks for Computer-Use Agents

    May 25, 2026Bowen Wang, Dunjie Lu, Junli Wang +11Computer-Use AgentsSynthetic Data Generation

  11. HyLaT: Efficient Multi-Agent Communication via Hybrid Latent-Text Protocol

    May 25, 2026Xinyi Mou, Siyuan Wang, Zejun Li +2Agent Communication ProtocolsLLM Agent Training

  12. LipoAgent: Coordinating Fine-Tuned LLM Agents for Safer Lipid Design

    May 24, 2026Leshu Li, An Lu, Haiyu Wang +5Multi-Agent LLM SystemsMaterials Science

  13. Hera: Learning Long-Horizon Coordination for Device-Cloud Collaborative LLM Agents

    May 23, 2026Yuxin Zhang, Mengxue Hu, Zheng Lin +8LLM Agent TrainingLLM Routing

  14. ECHO: Terminal Agents Learn World Models for Free

    May 23, 2026Vaishnavi Shrivastava, Piero Kauffmann, Ahmed Awadallah +1World Model LearningComputer-Use Agents

  15. SEAL: Synergistic Co-Evolution of Agents and Learning Environments

    May 23, 2026Yihao Hu, Zhihao Wen, Xiujin Liu +3LLM Agent TrainingSelf-Improving Agents

  16. QUEST: Training Frontier Deep Research Agents with Fully Synthetic Tasks

    May 22, 2026Jian Xie, Tianhe Lin, Zilu Wang +16Deep Research AgentsLLM Agent Training

  17. EVE-Agent: Evidence-Verifiable Self-Evolving Agents

    May 21, 2026Yamato Arai, Yuma IchikawaLLM Agent Self-ImprovementLLM Agent Training

  18. Spreadsheet-RL: Advancing Large Language Model Agents on Realistic Spreadsheet Tasks via Reinforcement Learning

    May 21, 2026Banghao Chi, Yining Xie, Mingyuan Wu +9Tool-Using AgentsLLM Agent Training

  19. Efficient Agentic Reasoning Through Self-Regulated Simulative Planning

    May 21, 2026Mingkai Deng, Jinyu Hou, Lara Sá Neves +4LLM PlanningWorld Model-Based Planning

  20. Terminal-World: Scaling Terminal-Agent Environments via Agent Skills

    May 20, 2026Zihao Cheng, Hongru Wang, Zeming Liu +6Tool-Augmented Language Model AgentsTerminal Agents

  21. Weasel: Out-of-Domain Generalization for Web Agents via Importance-Diversity Data Selection

    May 19, 2026Fatemeh Pesaran Zadeh, Seyeon Choi, Xing Han Lù +2OOD GeneralizationTraining Data Selection

  22. EnvFactory: Scaling Tool-Use Agents via Executable Environments Synthesis and Robust RL

    May 18, 2026Minrui Xu, Zilin Wang, Mengyi DENG +12Tool-Augmented Language Model AgentsAgentic RL

  23. HydroAgent: Closing the Gap Between Frontier LLMs and Human Experts in Hydrologic Model Calibration via Simulator-Grounded RL

    May 18, 2026Zhi Li, Songkun Yan, Jie Cao +4Reinforcement LearningModel Calibration