Long-Horizon Agents

Momentum

43 papers in the last four weeks, up 139% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 157

All topics
CardsList
  1. What Did the Agent Actually Do? Evidence-Grounded Oversight for Long-Horizon Agents

    Oct 5, 2026Zhongxiang Sun, Jiahao Yan, Hongkang Zhao +5Long-Horizon Agents

  2. Harness-Search: Guiding Long-Horizon Search through Multi-Agent Coordination

    Oct 4, 2026Shanyong Wang, Zhenwen Ji, Lei Jin +7Search AgentsLong-Horizon Agents

  3. EMBER-Bench: Benchmarking Cross-Event Causal Memory in Long-Horizon Embodied Tasks

    Oct 4, 2026Aoyang Cai, Boning Zhao, Shaoxuan Xie +5Long-Horizon AgentsEpisodic Memory

  4. SCAD: Structured Credit Assignment and Distillation for Long-Horizon Agents

    Oct 2, 2026Shangyang Wu, Shuai Zhao, Ziyue Zhu +3Long-Horizon AgentsCredit Assignment

  5. AutoCompact: Learning When to Compact Context in Long-Horizon Coding Agents

    Oct 1, 2026Xuan Zhang, Longtao Zheng, Cunxiao Du +2Coding AgentsCompaction

  6. Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States

    Oct 1, 2026Yu Luo, Jiamin Jiang, Yimin Zuo +9Long-Horizon AgentsLong-Horizon Task Planning

  7. VeriHarness: Scaling Agentic Verification for Long-Horizon Tasks

    Oct 1, 2026Caiqi Zhang, Rujun Han, Zifeng Wang +4Long-Horizon AgentsLong-Horizon Task Planning

  8. ReLiveGym: Evaluating Long-Lived Agents over Weeks of Replayed Reality

    Sep 30, 2026Xisen Jin, Jingheng Li, Zhenglun Chen +2Long-Horizon AgentsLong-Term Agent Memory

  9. Consistent Plan-Act for Long-Horizon Agentic Tasks

    Sep 30, 2026Heng-Zhuang Li, Yi-Kai Zhang, Yu Wang +4Long-Horizon AgentsGlobal Coordination

  10. Thinking Before Thinking: Scaling Agentic Inference Through Meta-Reasoning

    Sep 29, 2026Paras Dahal, Anton Bakhtin, Taco Cohen +9Agentic ReasoningAgentic Inference

  11. ContextRender: From Execution Dependencies to Agent Context

    Sep 29, 2026Savini Kashmira, Jayanaka L. Dantanarayana, Lingjia Tang +1Long-Horizon AgentsContextual Reasoning

  12. CADOC: Cache-Aware Dynamic Object Context for Long-Horizon Agents

    Sep 29, 2026Junjie Yao, Zhangchen Zhou, Zhi-Qin John XuLong-Horizon Agents

  13. Adapting Context Compression for Long-Horizon Agents with Counterfactual Continuations

    Sep 29, 2026Guanghui Min, Liang Wu, Mingjia Shi +4Long-Horizon AgentsInteraction History

  14. StateTape: Action-Conditioned Evidence Lifecycle Modeling for Long-Horizon Coding Agents

    Sep 28, 2026Ziyang Yu, Liang Zhao, Bowen Zhu +1Long-Horizon AgentsCoding Agents

  15. ARISE: Adapting to Evolving Capability Gaps in Agentic Reinforcement Learning

    Sep 28, 2026Kun Feng, Yuchen Fang, Yiyang Tan +6Agentic Reinforcement LearningLong-Horizon Agents

  16. Long-Horizon Scaling: How Model Capabilities Shape the Returns to Computation

    Sep 28, 2026Haoyu Zheng, Zhengyu Chen, Huaisheng Zhu +5Long-Horizon AgentsLong-Horizon Inference

  17. CEO Arena: Evaluating Long-Horizon Multi-Agent Decision-Making in Competitive Markets

    Sep 28, 2026An Yan, Yu Huo, Zhiwei Shang +2Long-Horizon AgentsStrategic Agents

  18. FromPitch2Board: Benchmarking LLM Agents in Long-Horizon Football Management

    Sep 28, 2026Peiyu ZangLong-Horizon AgentsAgentic Benchmarks

  19. Beyond Skill Evolution: Self-Evolving Context Management Policies for Long-Horizon Agent Harnesses

    Sep 28, 2026Weiyuan Li, Jinghan Xu, Aili Chen +4Long-Horizon AgentsLarge Language Model Agents

  20. FlowState: Execution State as Memory for Long-Horizon LLM Agents

    Sep 28, 2026Minghao Li, Bangyan Li, Zifan Wang +5Long-Horizon AgentsLong-Horizon Task Planning

  21. SGG-ReflAct: Sub-Goal Guided ReflAct with Structured Planning for Reliable Long-Horizon Reasoning

    Sep 28, 2026Jaeho Jung, Sung Hoon JungLarge Language Model PlanningHigh-Level Subgoal Generation

  22. StateGuard: Analytical-State Management with Validity-Aware Intervention for Long-Horizon Data Agents

    Sep 28, 2026Wenle Liao, Zhao Wang, Jingchao Zhang +3Long-Horizon AgentsData Science Agents

  23. Opera: A Verbal Critic Framework for Long-horizon Coding Agents

    Sep 27, 2026Kai Mei, Zhiyuan Hu, Yutong Dai +7CriticLong-Horizon Agents

  24. HyperMCTS: Hypergraph-Augmented MCTS for Long-Horizon LLM Agents

    Sep 27, 2026Tingsong Xiao, Nithish Balachandar Moudhgalya, Chandrayee Basu +5Monte Carlo Tree SearchLong-Horizon Agents

  25. Self-Designed Evaluators and Warm Memory for Long-Horizon Agents

    Sep 27, 2026Saeid Asgari, Emre Kiciman, Leonardo de Oliveira Nunes +1Self-Improving AgentsLong-Horizon Agents

  26. Trajectory Unlearning on LLM-based Agents

    Sep 27, 2026Yingdan Shi, Ren WangLong-Horizon AgentsRepair-Based Group-Relative Policy Optimization

  27. Beyond Timestamps: Decision-Aligned On-Policy Distillation for Long-Horizon Agents

    Sep 27, 2026Mingju Chen, Can Lv, Jinrong Liu +3Credit AssignmentLong-Horizon Agents

  28. Adaptive Consistency Graph for Long-Horizon Agents

    Sep 26, 2026Jiecong Wang, Hao Peng, Zhanyi WangLong-Horizon AgentsLong-Horizon Task Planning

  29. When Can Agents Forget Their Reasoning? ICLR for Long-Horizon Agent Context Compression

    Sep 24, 2026Mingxuan Wang, Fei Luo, Bo Wang +6Long-Horizon AgentsAgentic Reasoning

  30. The Tasteful Agent: Measuring and Improving Taste in Long-Horizon Tasks

    Sep 22, 2026Wenbo Pan, Zhichao Liu, Shujie Liu +6Long-Horizon AgentsAgentic Benchmarks

  31. Jev-Mem: System-One-Controlled Agentic Memory for Efficient AI Agents

    Sep 21, 2026Dongming Jiang, Yi Li, Bingzhe LiAgentic MemoryArtificial Intelligence Agents

  32. FLARE: A Full-Lifecycle Dense Supervision Paradigm for Long-Horizon Coding Agents via Generative Reward Model

    Sep 20, 2026Jingxuan Xu, Gang Wu, Yanan Wu +13Long-Horizon AgentsLifecycle

  33. SIMLIFE: Pattern Understanding for Long-Horizon Human-Agent Partnership

    Sep 17, 2026Run Peng, Zinnia Nie, Jing Ding +7Long-Horizon AgentsLife

  34. Locating Hidden Failures Makes Long-Horizon Agents More Reliable

    Sep 15, 2026Salman Rahman, Yubin Kim, Mihir Parmar +15Long-Horizon Agents

  35. BLINDSPOT: A Benchmark for Safety and Refusal Calibration in Long-Horizon Tool-Using Agents

    Sep 14, 2026Sadia Asif, Mohammad Mohammadi Amiri, Momin Abbas +2Long-Horizon AgentsAdversarial Evaluation

  36. LongAgent: History-Guided Agentic Search for Longitudinal Outcome Prediction

    Sep 14, 2026Siyao Wang, Florian Guitton, Shuojie Fu +3Long-Horizon AgentsLongitudinal

  37. Subagents vs Agent Skills: Executing Reusable Knowledge for Long-Horizon Agentic Tasks

    Sep 10, 2026Wasu Top Piriyakulkij, Rachel Lawrence, Alicia Curth +2Reusable Agent SkillsLong-Horizon Agents

  38. Polished but Unresolved: Identifying Late-Stage Pressure States in Long-Horizon Tool-Use Agents

    Sep 1, 2026Haoyang Chen, Yi Liu, Jianzhi Shao +3Long-Horizon AgentsAction Expert

  39. ContextPipe: Database-Inspired Context Assembly for Long-Horizon Agents

    Sep 1, 2026Peng Xu, Zuyu Zhang, Yuze Sun +3Long-Horizon AgentsProduction Agentic Systems

  40. E-Commerce Bench: Evaluating LLM Agents on Long-Horizon Autonomous Business Operation

    Aug 31, 2026Wei Fan, Xinjie Shen, Xudong Guo +8Long-Horizon AgentsLarge Language Model Agents

  41. Scaffolding Foundation Models into Physical-World Agents Pushes the Frontier of Long-Horizon Navigation

    Aug 31, 2026Zixing Lei, Gengze Zhou, Xiong-Hui Chen +7Long-Horizon AgentsEmbodied Agents

  42. CAST: Critique-Aware Supervision for Training Reliable Long-Horizon Tool-Calling Agents

    Aug 31, 2026Amir Saeidi, Zehua Zhang, Rishitosh Singh +6Large Language Model AgentsCritic-Free Reinforcement Learning

  43. When History Is Multimodal: Rethinking Context Management for Long-Horizon Agents

    Aug 30, 2026Jiaqi Su, Cong Pang, Jiawei Hong +4Multimodal MemoryLong-Horizon Agents

  44. SKILL.state: Scalable Long-Horizon Agent Skills

    Aug 26, 2026Sanket Badhe, Priyanka Tiwari, Jonghyun ChungLong-Horizon AgentsSkills

  45. Beyond Final Scores: A Systematic Evaluation of Agents for Long-Horizon AI Research and Development

    Aug 13, 2026Yiwei Li, Wanli Yang, Hexiang Tan +10Long-Horizon AgentsAutonomous Agents

  46. LLMs Are Not Good Strategists, Yet Memory-Enhanced Agency Boosts Reasoning

    Aug 12, 2026Yi Wu, Zhimin HuLong-Horizon AgentsLong-Horizon Task Planning

  47. LoongReflect: Boosting Long-Horizon Reflection in Search Agents via Global Perspective Distillation

    Aug 12, 2026Zhixin Zhang, Xinke Jiang, Zhibang Yang +5Long-Horizon AgentsAgentic Reinforcement Learning

  48. Efficient Reinforcement Learning for Long-Horizon Tool-Use Agentic Tasks

    Aug 11, 2026Zelei Cheng, Amritansh Mishra, Sambit Sahu +1Long-Horizon AgentsOffline Reinforcement Learning