Long-Horizon LLM Agents

LLM: Large Language Model

Momentum

60 papers in the last four weeks, up 161% on the four weeks before. 0.6% of all new papers.

Jul 13Week of Sep 28

Latest papers 297

All topics
CardsList
  1. GitHarness: Git Init Your Harness Working Memory for Perpetual User Requirements

    Sep 29, 2026Zhibang Yang, Xinke Jiang, Yuxuan Liu +9LLM Agent MemoryLong-Horizon LLM Agents

  2. Continuous Context Management

    Sep 28, 2026William Hoy, Jingxuan Fan, Nurcin Celik +1Context DistillationLong-Horizon LLM Agents

  3. SRHarness: A Harness for Agentic Symbolic Regression

    Sep 28, 2026Zihan Yu, Shixuan Zhou, Hao Huang +2Long-Horizon LLM AgentsLarge Language Model-Guided Scientific Discovery

  4. Long-Horizon Scaling: How Model Capabilities Shape the Returns to Computation

    Sep 28, 2026Haoyu Zheng, Zhengyu Chen, Huaisheng Zhu +5Cost-Aware InferenceInference-Time Scaling

  5. GraphHCA: Closed-Form Hindsight Credit Assignment for Long-Horizon LLM Agents

    Sep 28, 2026Haodong Zhu, Yangyang Ren, Changbai Li +4Credit Assignment in RLStep-Level Credit Assignment in RL

  6. RSI-Router: Evolving Subtask-Level LLM Routing and Skills for Cost-Efficient Agents

    Sep 28, 2026Hao Li, Hangfan Zhang, Zhiyao Cui +5Cost-Aware InferenceLLM Agent Workflow Optimization

  7. FromPitch2Board: Benchmarking LLM Agents in Long-Horizon Football Management

    Sep 28, 2026Peiyu ZangLong-Horizon Agent EvaluationAI Agent Benchmarks

  8. FlowState: Execution State as Memory for Long-Horizon LLM Agents

    Sep 28, 2026Minghao Li, Bangyan Li, Zifan Wang +5LLM Agent MemoryLong-Horizon LLM Agents

  9. SGG-ReflAct: Sub-Goal Guided ReflAct with Structured Planning for Reliable Long-Horizon Reasoning

    Sep 28, 2026Jaeho Jung, Sung Hoon JungLLM AgentsLong-Horizon LLM Agents

  10. Marathoner: Ultra-Long-Horizon Autonomous Intelligence

    Sep 28, 2026Zhang Ruiyang, Ou Jinpeng, Xie Yifan +4Long-Horizon Agent TasksLong-Horizon LLM Agents

  11. StateGuard: Analytical-State Management with Validity-Aware Intervention for Long-Horizon Data Agents

    Sep 28, 2026Wenle Liao, Zhao Wang, Jingchao Zhang +3LLM Agent VerificationGraph-Based Agent Memory

  12. From Attack Success to Attack Severity: Counterfactual Memory Attacks on LLM Agents

    Sep 28, 2026Mingxi Zou, Langzhang Liang, Zhuo Wang +3Adversarial AttacksAgent Memory Poisoning

  13. HyperMCTS: Hypergraph-Augmented MCTS for Long-Horizon LLM Agents

    Sep 27, 2026Tingsong Xiao, Nithish Balachandar Moudhgalya, Chandrayee Basu +5Monte Carlo Tree SearchLong-Horizon LLM Agents

  14. When Consent Outlives Context: Residual Authority Replay in Long-Lived Agents

    Sep 27, 2026Zhihao Zhang, Chao Wang, Rujia Li +3LLM Agent SecurityPrompt Injection Attacks on AI Agents

  15. When Successful Strategies Fail: Adaptation to Environmental Novelty in Terminal Agents

    Sep 27, 2026Janvijay Singh, Vaishnavi Shrivastava, Dilek Hakkani-Tur +2Long-Horizon Agent EvaluationAI Agent Benchmarks

  16. QwenGyre: An Elastic Reinforcement Learning Framework for Training xLong-Horizon Agents

    Sep 27, 2026Weiqi Wang, Yuxin Zhou, Mouxiang Chen +9Reinforcement LearningLong-Horizon Agent Tasks

  17. Dense Is Not Enough: Hierarchical Supervision Allocation for Long-Horizon On-Policy Distillation

    Sep 27, 2026Yuhao Sun, Binrui Wu, Zhuoer Xu +5On-Policy DistillationLong-Horizon Agent Tasks

  18. Agentic Multi-Turn Reasoning: A Fairness Approach

    Sep 27, 2026Thanh-Dat Truong, Sankalp Pandey, Hugh Churchill +3Preference OptimizationAgentic Reasoning

  19. Adaptive Consistency Graph for Long-Horizon Agents

    Sep 26, 2026Jiecong Wang, Hao Peng, Zhanyi WangLong-Horizon Agent EvaluationGraph-Based Agent Memory

  20. LLM Parkinsonism: Executive-Control Failure, Token-Inefficient Persistence, and an Uncertainty-Aware Global Executive Control Architecture for Autonomous Language-Model Agents

    Sep 25, 2026Dongsheng Xiao, Zeyuan Wang, Xuzhe Xia +2Overthinking in Language ModelsLLM Agents

  21. When Can Agents Forget Their Reasoning? ICLR for Long-Horizon Agent Context Compression

    Sep 24, 2026Mingxuan Wang, Fei Luo, Bo Wang +6Long-Context ModelingLong-Horizon LLM Agents

  22. IterSynth: Rethinking Deep Search Agents via Role-Decoupled Iterative Synthesis

    Sep 24, 2026Xingyu Wu, Yuchen Yan, Zhengxi Lu +9Long-Horizon LLM AgentsRL for LLM Agents

  23. Agent-Editing World Model: Rethinking World Modeling for LLM Agents

    Sep 23, 2026Shuang Sun, Guoxin Chen, Fanzhe Meng +6LLM World ModelsWorld Models

  24. Learning from Failures: Heterogeneous Graph Memory for Small Language Model Tool-Using Agents

    Sep 23, 2026Jiaxing Li, Lei Song, Rui Dong +1Graph-Based Agent MemoryLong-Horizon LLM Agents

  25. Verifiable Hidden Dynamics Play: Generating Agentic RL Environments from Solved Mechanisms

    Sep 23, 2026Xinjie Shen, Wei Fan, Xudong Guo +5Agentic RLReinforcement Learning

  26. Harness as a Language: A Minimalist Agent Framework With Maximal Expressivity

    Sep 22, 2026Zhening Li, Joshua Liu, Mateja Vukelic +7LLM Agent MemoryLLM Agent Self-Improvement

  27. CliffCompaction: Cost-Efficient Compaction for Long-Horizon Coding Agents

    Sep 22, 2026Trang Nguyen, Eulrang Cho, Bingqing Chen +1Continual Learning for LLM AgentsTest-Time Scaling