LLM Agent Training

LLM: Large Language Model

Latest papers 354

All topics
CardsList
  1. Environmental Feedback Modeling Matters: Rethinking Feedback Treatment in Agentic Hindsight Self-Distillation

    Oct 8, 2026Hangxi Guo, Fengyuan Liu, Yue Wang +4LLM Agent TrainingSelf-Distillation

  2. Training Advisors for LLM Agents from Task Outcomes

    Oct 7, 2026Sergei Polezhaev, Barys Liskavets, Ori Press +1LLM Agent TrainingRL for LLM Agents

  3. MIMESIS: Learning User Simulators as Training Environments for Interactive Agents

    Oct 7, 2026Hoang Phan, Dat Huynh, Andrey Zhmoginov +7User SimulationLLM Agent Training

  4. GraphOPD: Graph-Augmented On-Policy Distillation for LLM Agents

    Oct 6, 2026Bohan Lin, Liyi Chen, Zhuoning Guo +5LLM Agent TrainingOn-Policy Distillation

  5. AdvSim2Real : Training Web Agents Against Adaptive Prompt Injection in a Web World Model

    Oct 6, 2026Sarim Hashmi, Mukul Ranjan, Kshitij Mishra +3Adversarial TrainingSim-to-Real Transfer

  6. RAISED: Self-Distillation for Robustness to Prompt Injection in LLM Agents

    Oct 5, 2026Mohamed Dhouib, Clement Elliker, Alexi Canesse +5Prompt Injection DefenseLLM Agents

  7. Imagine to Act: High-Fidelity Data Synthesis via Image Editing World Model for Scalable GUI Agent Training

    Oct 5, 2026Yongxin Ning, Runliang Niu, Qianli Xing +4World ModelsSynthetic Data Generation

  8. Selecting Long-Horizon Trajectories for Reliable and Efficient Terminal-Agent Training

    Oct 5, 2026Cuong Dang, Hoang Anh Just, Ruoxi JiaSupervised Fine-TuningTrajectory Generation

  9. Sibyl: An Efficient Small-large Model Collaboration Framework for Long-horizon Tasks

    Oct 4, 2026Zhewei Fang, Yuxin Zhang, Zhenwei Shao +8LLM Agent TrainingLong-Horizon LLM Agents

  10. Harness Annealing: Learning to Act with Less External Control

    Oct 1, 2026Yingxuan Yang, Huacan Chai, Ying WenLanguage Model-Based ControlAgent Harness Optimization

  11. Federated Agent Optimization

    Oct 1, 2026Qiang Yang, Zhiqiang Kou, Xueyi Zhang +6LLM Agent TrainingFederated Learning

  12. It Takes Workflows to Evolve Better Workflows

    Oct 1, 2026Xuehang Guo, Haoyu Wang, Haifeng Chen +3LLM Agent Workflow OptimizationMulti-Agent Collaboration

  13. PG-SFT: Balancing Capability Acquisition and Retention in Offline Agent Fine-Tuning

    Oct 1, 2026Ronghua Li, Zi Liang, Zhishan Li +1Supervised Fine-TuningLLM Agent Training

  14. PivotOPD: Learning to Recover from Pivotal Mistakes in Multi-Turn Agents

    Sep 30, 2026Yinghui He, Yapei Chang, Khushi Bhardwaj +4Language Model DistillationLLM Agent Training

  15. PhantomEnvironments: Training LLM Agents in Fictional Worlds

    Sep 30, 2026Anmol Kabra, Swathi Saravana Selvam, Albert Gong +5Multi-Hop QAReinforcement Learning

  16. Learning Reliable GUI Agents under Imperfect Priors

    Sep 30, 2026Bo Han, Qianyi Wang, Shuai Liu +9GUI AgentsLLM Agent Training

  17. WorkGenesis: Building the Worlds That Teach Agents to Work

    Sep 30, 2026Xinyu Zhu, Fenyi Liu, Yuzhu Cai +4LLM Agent TrainingSynthetic Data Generation for Language Models

  18. GraphForge: Training Working Agents with Graph-Anchored Workspace Synthesis

    Sep 30, 2026Qisheng Su, Hanchen Wang, Guanru Zhu +10AI Agent BenchmarksLLM Agent Training

  19. GraphCert: Bootstrap Agentic Graph Reasoning with Certified Evidence Rubrics

    Sep 30, 2026Weiqi Jiang, Yuchen Ying, Rui Wang +5LLM Reasoning with GraphsRL for Language Model Reasoning

  20. EVOKE: Eliciting World Knowledge in Agents for Transferable Decision-Making

    Sep 29, 2026Yuhan Guo, Jinming Liu, Liang Xu +8LLM Agent TrainingGeneralization in RL

  21. Character Training for Risk-Averse Agents

    Sep 29, 2026Arav Dhoot, Punya Syon Pandey, Jamie Johnson +3Risk-Sensitive RLAI Agent Safety

  22. HybridCUA: Learning to Orchestrate GUI and CLI for Computer-Use Agents

    Sep 29, 2026Tongbo Chen, Junbo Niu, Zhengxi Lu +8Computer-Use AgentsGUI Agents

  23. AREX-2: Advancing Self-Improving Agents through Long-Horizon Reflective Tasks

    Sep 29, 2026Hongjin Qian, Chaofan Li, Kun Luo +11LLM Self-RefinementLLM Agent Training