Long-Horizon LLM Agents

LLM: Large Language Model

Momentum

60 papers in the last four weeks, up 161% on the four weeks before. 0.6% of all new papers.

Jul 13Week of Sep 28

Latest papers 297

All topics
CardsList
  1. Use and Disuse: Intent-Structured Experience Consolidation for Memory and Learning in LLM Agents

    Oct 8, 2026Xiangyi Zeng, Baihang Liu, Xutong Wang +3Memory-Augmented Language Model AgentsContinual Learning for LLM Agents

  2. Harness Evolution Hits a Ceiling: When Weight Training Should Begin

    Oct 8, 2026Yuan Tian, Bing Hu, Hao Wang +2Long-Horizon LLM AgentsLLM Agent Harnesses

  3. SWE-Journey: Towards More Realistic Evaluation of Coding Assistants through Long-Horizon, Multi-Turn Interaction

    Oct 8, 2026Hexuan Deng, Yue Wang, Wenyu Jiang +13Coding AgentsAI Agent Benchmarks

  4. Safe, Persistent, and Evolving Agent Harness for Understanding Partially Observable Worlds

    Oct 8, 2026Yisen Gao, Yue Guo, Qing Zong +2LLM Agent HarnessesLLM Agent Safety

  5. Plan-and-Patch: Diffusion Language Models for Agentic Planning

    Oct 7, 2026Syamantak Kumar, Jiang Guo, Hassan Hamad +6LLM PlanningDiffusion-Based Planning

  6. Learning Situation-Conditioned Thinking Policies for Long-Term LLM Agents

    Oct 7, 2026Hong SuLLM Agent MemoryLong-Horizon LLM Agents

  7. World Potential Model: Pretrained World Knowledge as Progress Potentials

    Oct 7, 2026Jun Zhao, Jixin Tang, Yang Shu +6Long-Horizon LLM AgentsRL for LLM Agents

  8. ReFold: Training-Free Reversible Inter-Turn Context Folding for Long-Horizon Agents

    Oct 6, 2026Yupeng Su, Jiayi Tian, Zheng Zhang +1LLM Inference EfficiencyLong-Context Language Model Inference

  9. Harness Engineering for Software Engineering via Modular Executable Dev-Primitives

    Oct 6, 2026Haibo Jin, Xinjie Li, Peng Kuang +1Multi-Agent LLM SystemsSoftware Engineering Agents

  10. Selective Critique for Cost-Aware LLM Agents in Long-Horizon Decision Making

    Oct 5, 2026Heewon Park, Somin Im, Minhae KwonLong-Horizon LLM AgentsLLM Agent Reliability

  11. AMBER: Training Long-Horizon Web Agents through Append-Only Memory

    Oct 5, 2026Chinmay Savadikar, Zhaoyu Zhang, Mingyu Zhao +4Long-Horizon LLM AgentsAgent Memory Management

  12. RocketAgent: A Long-Horizon Engineering Agent for Multidisciplinary Design of Liquid-Rocket Thrust Chambers

    Oct 5, 2026Junxiang He, Runze Mao, Kun He +4Model-Based Systems EngineeringLLM Agent Orchestration

  13. VERA: Scaling Verifiable Environments for Agentic co-Evolution

    Oct 5, 2026Junqi Liu, Yongyang Pan, Zhuosong Jiang +14Reinforcement Learning with Verifiable RewardsLong-Horizon LLM Agents

  14. Selecting Long-Horizon Trajectories for Reliable and Efficient Terminal-Agent Training

    Oct 5, 2026Cuong Dang, Hoang Anh Just, Ruoxi JiaSupervised Fine-TuningTrajectory Generation

  15. Sibyl: An Efficient Small-large Model Collaboration Framework for Long-horizon Tasks

    Oct 4, 2026Zhewei Fang, Yuxin Zhang, Zhenwei Shao +8LLM Agent TrainingLong-Horizon LLM Agents

  16. Mimir: Physics-Grounded LLM Agents for Long-Horizon Irrigation Control

    Oct 1, 2026Yimeng Liu, Mi Zhang, Younsuk Dong +1Language Model-Based ControlLLM Agent Self-Improvement

  17. Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States

    Oct 1, 2026Yu Luo, Jiamin Jiang, Yimin Zuo +9Belief Updating in LLMsLong-Horizon LLM Agents

  18. VeriHarness: Scaling Agentic Verification for Long-Horizon Tasks

    Oct 1, 2026Caiqi Zhang, Rujun Han, Zifeng Wang +4LLM Agent VerificationLong-Horizon LLM Agents

  19. PhantomEnvironments: Training LLM Agents in Fictional Worlds

    Sep 30, 2026Anmol Kabra, Swathi Saravana Selvam, Albert Gong +5Multi-Hop QAReinforcement Learning

  20. OverForge: Reasoning Through Strategies and Tactics Helps Cooperative Lifelong Adaptation

    Sep 30, 2026Oana Madalina Fron, Ojas Shirekar, Chirag RamanContinual Learning for LLM AgentsMulti-Agent LLM Systems

  21. Beyond Oracle Communication: Benchmarking Interactive Intent Alignment Under Miscommunication and Evolving User Intent

    Sep 29, 2026Zheyuan Zhang, Mengyuan Chao, Ke Xiao +5LLM AlignmentLLM Agent Evaluation

  22. Do LLM Agents Execute the Plans They Declare? From Planning-Mode Declaration to Pattern-Specific Execution

    Sep 29, 2026Subba Reddy Oota, Francisco Herrera, Jordi Cabot Sagrera +2LLM AgentsLong-Horizon LLM Agents

  23. AREX-2: Advancing Self-Improving Agents through Long-Horizon Reflective Tasks

    Sep 29, 2026Hongjin Qian, Chaofan Li, Kun Luo +11LLM Self-RefinementLLM Agent Training

  24. ContextRender: From Execution Dependencies to Agent Context

    Sep 29, 2026Savini Kashmira, Jayanaka L. Dantanarayana, Lingjia Tang +1Graph-Based Agent MemoryLong-Horizon LLM Agents

  25. FOCUS: Training-Free Decision-Preserving Context Compression for LLM Agents

    Sep 29, 2026Shantanu Dixit, Anson Bastos, Xuchao Zhang +2Long-Horizon LLM AgentsLLM Context Management