LLM Agent Training

LLM: Large Language Model

Latest papers 354

All topics
CardsList
  1. AutoTrainess: Teaching Language Models to Improve Language Models Autonomously

    Jun 30, 2026Zhaojian Yu, Penghao Yin, Shuzheng Gao +3Tool-Augmented Language Model AgentsLLM Tool Use

  2. Calibrating the Evaluator: Does Probability Calibration Mitigate Preference Coupling in LLM Agent Feedback Loops?

    Jun 30, 2026Zewen LiuLLM-as-a-JudgePairwise Preference Evaluation

  3. Agentic-Ideation: Sample Efficient Agentic Trajectories Synthesis for Scientific Ideation Agents

    Jun 30, 2026Keyu Zhao, Lingyan Kong, Fengli Xu +1Multi-Agent LLM SystemsAI Agents for Scientific Discovery

  4. DuoMem: Towards Capable On-Device Memory Agents via Dual-Space Distillation

    Jun 29, 2026Peyman Hosseini, Ondrej Bohdal, Ahmed Alajrami +6LLM AgentsLLM Agent Training

  5. MIThinker: A Plug-and-Play Policy-Optimized Thinker For Motivational Interviewing Counseling

    Jun 28, 2026Yizhe Yang, Palakorn Achananuparp, Heyan Huang +2Mental Health CounselingEmotional Support Conversation

  6. An AI agent for treatment reasoning over a biomedical tool universe

    Jun 27, 2026Shanghua Gao, Ayush Noori, Richard Zhu +13Clinical Decision-MakingLLM Agent Training

  7. LLawCo: Learning Laws of Cooperation for Modeling Embodied Multi-Agent Behavior

    Jun 26, 2026Qinhong Zhou, Chuang Gan, Anoop CherianMulti-Agent CoordinationAI Alignment

  8. Internalizing the Future: A Unified Agentic Training Paradigm for World Model Planning

    Jun 25, 2026Xuan Zhang, Zhijian Zhou, Lingfeng Qiao +6World Model-Based PlanningModel-Based Planning

  9. Empowering GUI Agents via Autonomous Experience Exploration and Hindsight Experience Utilization for Task Planning

    Jun 25, 2026Tianyi Men, Zhuoran Jin, Pengfei Cao +3GUI AgentsLLM Agent Training

  10. Where Do CoT Training Gains Land in LLM based Agents?

    Jun 25, 2026Jingyu Liu, Zhiwen Wang, Yuxin Jing +2CoT ReasoningLLM Agents

  11. OpenThoughts-Agent: Data Recipes for Agentic Models

    Jun 23, 2026Negin Raoof, Richard Zhuang, Marianna Nezhurina +47Training Data CurationLLM Agent Training

  12. Tmax: A simple recipe for terminal agents

    Jun 22, 2026Hamish Ivison, Junjie Oscar Yin, Rulin Shao +3Synthetic Data GenerationTerminal Agents

  13. PhoneBuddy: Training Open Models for Agentic Phone Use

    Jun 22, 2026Zhengyang Tang, Xin Lai, Pengyuan Lyu +23Computer-Use AgentsMobile GUI Agents

  14. CLI-Universe: Towards Verifiable Task Synthesis Engine for Terminal Agents

    Jun 22, 2026Zhanbo Hua, Yifan Yao, Weihao Xie +14LLM Agent Trajectory SynthesisLLM Agents

  15. MetaPS: Adaptive Programmatic Strategy Selection for Market Agents

    Jun 21, 2026Jiaxiang Chen, Aotian Luo, Zhouyi Zheng +3Algorithm SelectionLLM Agent Training

  16. Drowning in Routine: Signal Dilution in Multi-Turn Agent Training

    Jun 20, 2026Yann Pernot, Vi RetaultReinforcement LearningCredit Assignment in RL

  17. Steer, Don't Solve: Training Small Critic Models for Large Code Agents

    Jun 20, 2026Shubham Gandhi, Yiqing Xie, Atharva Naik +2LLM-as-a-JudgeAI Coding Agents

  18. Training the Orchestrator: A Supervised Approach to End-to-End PDDL Planning with LLM Agents

    Jun 19, 2026Rajesh Mangannavar, Zachary Coalson, Pranay Dugar +1LLM PlanningSymbolic Planning

  19. Sakana Fugu Technical Report

    Jun 19, 2026Yujin Tang, Edoardo Cetin, Jinglue Xu +11LLM Agent OrchestrationLLM Agent Training

  20. When Lower Privileges Suffice: Investigating Over-Privileged Tool Selection in LLM Agents

    Jun 18, 2026Kaiyue Yang, Yuyan Bu, Jingwei Yi +5LLM Agent SecurityAI Agent Security Benchmarks

  21. Connect the Dots: Training LLMs for Long-Lifecycle Agents with Cross-Domain Generalization Via Reinforcement Learning

    Jun 18, 2026Yanxi Chen, Weijie Shi, Boyi Hu +6Continual Learning for LLM AgentsCross-Domain Generalization

  22. ProfiLLM: Utility-Aligned Agentic User Profiling for Industrial Ride-Hailing Dispatch

    Jun 17, 2026Tengfei Lyu, Zirui Yuan, Xu Liu +4User ModelingLLM Agent Training