LLM Agent Training

LLM: Large Language Model

Latest papers 354

All topics
CardsList
  1. SAGE: An LLM-driven Self Reflective Agentic Framework for Fraud Detection

    Jun 6, 2026Yichen Chen, Siying Li, Yuhang Liang +2Multi-Agent LLM SystemsFinancial Fraud Detection

  2. Agentopia: Long-Term Life Simulation and Learning in Agent Societies

    Jun 5, 2026Xintao Wang, Sirui Zheng, Hongqiu Wu +10Multi-Agent LLM SystemsHuman Behavior Simulation

  3. From Risk Classification to Action Plan Remediation: A Guardrail Feedback Driven Framework for LLM Agents

    Jun 4, 2026Yuhao Sun, Jiacheng Zhang, Shaanan Cohney +3LLM GuardrailsLLM Agent Training

  4. CollabBench: Benchmarking and Unleashing Collaborative Ability of LLMs with Diverse Players via Proactive Engagement

    Jun 4, 2026Hong Qian, Yuanhao Liu, Zihan Zhou +7Game-Playing AgentsHuman Behavior Simulation

  5. AdaMEM: Test-Time Adaptive Memory for Language Agents

    Jun 4, 2026Yunxiang Zhang, Yiheng Li, Ali Payani +1Agent MemoryTest-Time Adaptation

  6. Self-Evolving Deep Research via Joint Generation and Evaluation

    Jun 3, 2026Han Zhu, Chengkun Cai, Yuanfeng Song +3LLM EvaluationLLM Agent Training

  7. What Makes Interaction Trajectories Effective for Training Terminal Agents?

    Jun 2, 2026Sidi Yang, Chaofan Tao, Jierun Chen +11AI Agent BenchmarksLLM Agent Training

  8. RUBAS: Rubric-Based Reinforcement Learning for Agent Safety

    Jun 2, 2026Xian Qi Loye, Qinglin Su, Zhexin Zhang +5Reinforcement LearningAI Agent Safety

  9. Uncertainty-Aware Clarification in LLM Agents with Information Gain

    Jun 2, 2026Mengyi Deng, Zhiwei Li, Xin Li +4Clarification Question GenerationTool-Using Agents

  10. EvoTrainer: Co-Evolving LLM Policies and Training Harnesses for Autonomous Agentic Reinforcement Learning

    Jun 2, 2026Guhong Chen, Yingcheng Shi, Yongbin Li +6RL for Code GenerationAgentic RL

  11. Libra: Efficient Resource Management for Agentic RL Post-Training

    Jun 2, 2026Kaiwen Chen, Xin Tan, Jingzong Li +6Agentic RLReinforcement Learning

  12. WRIT: Write-Read Intensive Trajectory Synthesis for Multi-Turn User-Facing Agents

    Jun 1, 2026Hengrui Gu, Xiaotian Han, Kaixiong ZhouTool-Augmented Language Model AgentsTool-Using Agents

  13. Adaptive Latent Agentic Reasoning

    Jun 1, 2026Dongwon Jung, Peng Shi, Yi Zhang +2Agentic ReasoningLLM Agents

  14. Policy and World Modeling Co-Training for Language Agents

    Jun 1, 2026Ning Lu, Baijiong Lin, Shengcai Liu +9Agentic RLWorld Model Learning

  15. CoMAP: Co-Evolving World Models and Agent Policies for LLM Agents

    Jun 1, 2026Youwei Liu, Jian Wang, Hanlin Wang +1LLM World ModelsLLM Agent Training

  16. Scaling Agentic Capabilities via Grounded Interaction Synthesis

    Jun 1, 2026Wenhang Shi, Jinhao Dong, Yiren Chen +4Synthetic Data GenerationLLM Agent Training

  17. HomeFlow: A Data Flywheel for Smart Home Agent Training with Verifiable Simulation

    May 31, 2026Yi Gu, Huacan Wang, Shuo Zhang +10AI Agent BenchmarksLLM Agent Training

  18. CAREAgent: Clinical Agent with Structured Reasoning and Tool-Integrated for Order Generation

    May 31, 2026Ruihui Hou, Ziyue Huai, Chennuo Zhang +5Tool-Using AgentsClinical Reasoning

  19. BAGEN: Are LLM Agents Budget-Aware?

    May 29, 2026Yuxiang Lin, Zihan Wang, Mengyang Liu +9LLM Agent EvaluationAI Agent Benchmarks

  20. Learning to Construct Practical Agentic Systems

    May 29, 2026Aditya Kumar, Zhihan Lei, Jerry Yan +6LLM Agent OrchestrationAgentic Workflows

  21. Used Car Salesbots? Honesty and Credulity of LLMs as Bargaining Agents under Partial Information

    May 29, 2026Antonio Valerio Miceli-Barone, Vaishak Belle, Shay B. CohenMulti-Agent LLM SystemsMulti-Agent Negotiation

  22. COMPASS: Cognitive MCTS-Guided Process Alignment for Safe Search Agents

    May 29, 2026Wenkai Shen, Pengyang Zhou, Jiahe Xu +5LLM Safety AlignmentLLM Agents

  23. LiteCoder-Terminal: Scaling Long-Horizon Terminal Environments for Learning Language Agents

    May 28, 2026Xiaoxuan Peng, Kaiqi Zhang, Xinyu Lu +5RL for Language ModelsTerminal Agents

  24. GrepSeek: Training Search Agents for Direct Corpus Interaction

    May 28, 2026Alireza Salemi, Chang Zeng, Atharva Nijasure +4Tool-Augmented Language Model AgentsAgentic Search