LLM Agent Training

LLM: Large Language Model

Latest papers 354

All topics
CardsList
  1. Does RL Expand the Capability Boundary of LLM Agents? A PASS@(k,T) Analysis

    Apr 16, 2026Zhiyuan Zhai, Wenjing Yan, Xiaodan Shao +1LLM Agent TrainingRL for LLM Agents

  2. Mind DeepResearch Technical Report

    Apr 16, 2026MindDR Team, Li Auto IncMulti-Agent LLM SystemsDeep Research Agents

  3. UniToolCall: Unifying Tool-Use Representation, Data, and Evaluation for LLM Agents

    Apr 13, 2026Yijuan Liang, Xinghao Chen, Yifan Ge +5LLM Agent EvaluationAI Agent Benchmarks

  4. Agentic Tool Use in Large Language Models

    Apr 1, 2026Jinchao Hu, Meizhi Zhong, Kehai Chen +2LLM Agent EvaluationTool-Using Agents

  5. Meta-TTL: Meta-Learning Self-Improvement Policies for Language Agents

    Apr 1, 2026Zhanzhi Lou, Hui Chen, Yibo Li +2Meta-LearningTest-Time Training

  6. Retrieval-Augmented LLM Agents: Learning to Learn from Experience

    Mar 18, 2026Thomas Palmeira Ferraz, Romain Deffayet, Vassilina Nikoulina +2Fine-TuningLLM Agent Training

  7. OpenResearcher: A Fully Open Pipeline for Long-Horizon Deep Research Trajectory Synthesis

    Mar 17, 2026Zhuofeng Li, Dongfu Jiang, Xueguang Ma +7Deep Research AgentsLLM Agent Trajectory Synthesis

  8. The Trace Is the State: Exact Credit Assignment for LLM Agent Teams

    Mar 6, 2026Yanjun Chen, Yirong Sun, Hanlin Wang +5Credit AssignmentCounterfactual Credit Assignment

  9. ARLArena: A Unified Framework for Stable Agentic Reinforcement Learning

    Feb 25, 2026Xiaoxuan Wang, Han Zhang, Haixin Wang +11Agentic RLReinforcement Learning

  10. TSR: Trajectory-Search Rollouts for Multi-Turn RL of LLM Agents

    Feb 12, 2026Aladin Djuhera, Swanand Kadhe, Farhan Ahmed +3Tree SearchLLM Agent Training

  11. GAIA: A Data Flywheel System for Training GUI Test-Time Scaling Critic Models

    Jan 26, 2026Shaokang Wang, Pei Fu, Ruoceng Zhang +7GUI AgentsTest-Time Scaling

  12. OpenTinker: Separating Concerns in Agentic Reinforcement Learning

    Jan 12, 2026Siqi Zhu, Jiaxuan YouAgentic RLLLM Agent Training

  13. InfiniteWeb: Scalable Web Environment Synthesis for GUI Agent Training

    Jan 7, 2026Ziyun Zhang, Zezhou Wang, Xiaoyi Zhang +4Web Application GenerationGUI Agents

  14. SCRIBE: Structured Mid-Level Supervision for Tool-Using Language Models

    Jan 7, 2026Yuxuan Jiang, Francis FerraroProcess Reward ModelsRL for Language Model Reasoning

  15. Who Gets the Reward & Who Gets the Blame? Evaluation-Aligned Training Signals for Multi-LLM Agents

    Nov 11, 2025Chih-Hsuan, Yang, Tanwi Mallick +5Multi-Agent LLM SystemsCooperative Game Theory

  16. Communication and Verification in LLM Agents towards Collaboration under Information Asymmetry

    Oct 29, 2025Run Peng, Ziqiao Ma, Amy Pang +5Multi-Agent LLM SystemsLLM Agent Verification

  17. OpenPhone: Mobile Agentic Foundation Models

    Oct 24, 2025Yangqin Jiang, Chao HuangOn-Device Language Model InferenceGUI Agents

  18. BuilderBench: The Building Blocks of Intelligent Agents

    Oct 7, 2025Raj Ghugare, Roger Creus Castanyer, Catherine Ji +4Long-Horizon Agent EvaluationRobot Manipulation Benchmarks

  19. Interactive Learning for LLM Reasoning

    Sep 30, 2025Hehai Lin, Shilei Cao, Sudong Wang +5RL for Language Model ReasoningLLM Agent Training

  20. DeepTravel: An End-to-End Agentic Reinforcement Learning Framework for Autonomous Travel Planning Agents

    Sep 26, 2025Yansong Ning, Rui Liu, Jun Wang +6Agentic RLLLM Agent Training

  21. Web-CogReasoner: Towards Multimodal Knowledge-Induced Cognitive Reasoning for Web Agents

    Aug 3, 2025Yuhan Guo, Cong Guo, Aiwen Sun +12Cognitive ModelingMultimodal Reasoning

  22. Meta-SecAlign: Training LLMs against Prompt Injection for Robust Agents

    Jul 3, 2025Sizhe Chen, Arman Zharmagambetov, David Wagner +1LLM Agent SecurityAI Agent Security Benchmarks

  23. Clearing the Fog: Towards Installing and Refining Proactive Exploration Capabilities in LLM Agents

    Date pendingZhizhao Guan, Chen Huang, Ziming Liu +5RL ExplorationLLM Agents