LLM Agent Training

LLM: Large Language Model

Latest papers 354

All topics
CardsList
  1. Direct Diversity Optimization for Diverse Successful Trajectories in Preference Post-Training

    Sep 9, 2026Junwon Ko, Dong-Jae Lee, Minchan Kwon +2Offline RLPreference Optimization

  2. MARBO: Relational Belief Grounding for LLM Agents in Social Deduction Games

    Sep 6, 2026Yechan Hwang, Sangjun Bae, Jeongmo Kim +2Game-Playing AgentsSocial Deduction Games

  3. First Things First: Teaching LLM-Based Agents to Prioritize Must-Haves before Nice-to-Haves

    Sep 4, 2026Tianjie Ju, Xinyue Xu, Wanxuan Sun +4RL for Language Model ReasoningAI Agent Benchmarks

  4. Iris: Climbing to the Search Frontier

    Sep 3, 2026Ziyuan Liu, Hengqi Liu, Zichuan Wang +8Multi-Hop QAWeb Search Agents

  5. Terminal-Universe: Turning Agent Trajectories into Scalable Terminal Environments

    Sep 3, 2026Jie Wu, Zhenru Zhang, Beichen Zhang +11Software Engineering AgentsLLM Agent Trajectory Synthesis

  6. PersuaRL: Reinforcement Learning-Driven Multi-Expert Selection for Persuasive Dialogue Generation in Insurance

    Sep 1, 2026Rohan Kirti, Akash Ghosh, Aryan Vats +5RL for Language ModelsLLM Agent Training

  7. WHALE: A Simple Recipe for Joint Harness-Weight Optimization

    Aug 31, 2026Haechan Kim, Yoonho Lee, Gisang Lee +2Agent Harness OptimizationLLM Agent Training

  8. SimCRAFT: Distilling Remote Sensing Agents via Synthetic Trajectories and Contextual Retrieval-Augmented Fine-Tuning

    Aug 31, 2026Haoran Wang, Jing Yao, Xu Yang +4Fine-TuningRemote Sensing

  9. CAST: Critique-Aware Supervision for Training Reliable Long-Horizon Tool-Calling Agents

    Aug 31, 2026Amir Saeidi, Zehua Zhang, Rishitosh Singh +6LLM AgentsLLM Agent Training

  10. Beyond Task Completion: Training Capable and Safe Computer-Use Agents

    Aug 27, 2026Zeyu Kang, Zhenyun Yin, Yang Zhang +5Computer-Use AgentsAI Agent Safety

  11. CyberFactory: Scaling Cyber Security Capabilities with Instances from the Wild

    Aug 24, 2026Jian Yang, Haau-Sing Li, Shawn Guo +10CybersecuritySoftware Security

  12. One Frozen Simulator Is Not Enough: Simulator Collapse in Multi-Agent RL

    Aug 12, 2026Simon Yu, Nicholas Tomlin, Marwa Abdulhai +7Multi-Agent LLM SystemsHuman Behavior Simulation

  13. ExRole: From Team Trajectories to Executable Roles in Multi-Agent Language Models

    Aug 12, 2026Zhou Liu, Chaoyang Han, Zewei Pan +2LLM Agent TrainingMulti-Agent LLMs

  14. MERA: Model Evolution and Routing with Skill Adaptation for Agentic Systems at Scale

    Aug 11, 2026Yuhang Yao, Zeyu Wang, Wanyi Chen +8Continual Learning for LLM AgentsLLM Fine-Tuning

  15. Open Evaluation Agent: Efficient and Promptable Evaluation of Visual Generative Models

    Aug 10, 2026Shulin Tian, Ziqi Huang, Fan Zhang +3Tool-Augmented Language Model AgentsAI Agent Evaluation

  16. Beyond the Capability Boundary: Zeroth-Order Optimization for Self-Evolving LLM Agents

    Aug 10, 2026Bingzhen Liu, Xiaomeng Fan, Yuwei Wu +4Zeroth-Order OptimizationLLM Agent Training

  17. Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing

    Aug 7, 2026Jiacheng Miao, Jin Mu, Guanhua Chen +1AI Agent BenchmarksLLM Agent Training

  18. CyberForge: Verified Vulnerability Injection at Repository Level for Cybersecurity Agent Training

    Aug 6, 2026Amine Lbath, Manan Suri, Aurelien Delaitre +4Automated Program RepairSoftware Vulnerability Detection

  19. CalibForge: Adversarial Solver Calibration for Scaling Learnable Terminal Tasks

    Aug 6, 2026Fanzhe Meng, Guoxin Chen, Jiale Zhao +6LLM Agent TrainingAgent Benchmarks