Long-Horizon LLM Agents

LLM: Large Language Model

Momentum

60 papers in the last four weeks, up 161% on the four weeks before. 0.6% of all new papers.

Jul 13Week of Sep 28

Latest papers 297

All topics
CardsList
  1. How Strongly Should Task State Influence an LLM Agent?

    Sep 22, 2026Chenyu Zhang, Wonbin Kweon, Jiawei HanLLM Agent EvaluationRuntime Enforcement for AI Agents

  2. Emergent Collusion in Long-Horizon LLM Agent Interaction

    Sep 21, 2026Xinrui Shi, Yanzhe Zhang, Diyi YangMulti-Agent CoordinationLLM Agent Safety

  3. Jev-Mem: System-One-Controlled Agentic Memory for Efficient AI Agents

    Sep 21, 2026Dongming Jiang, Yi Li, Bingzhe LiLLM Agent MemoryGraph-Based Agent Memory

  4. FLARE: A Full-Lifecycle Dense Supervision Paradigm for Long-Horizon Coding Agents via Generative Reward Model

    Sep 20, 2026Jingxuan Xu, Gang Wu, Yanan Wu +13RL for Code GenerationReward Modeling

  5. Auto-RecSys: Harnessing Autonomous Research Agents for Industry-Scale Recommender System

    Sep 11, 2026Ming Li, Dai Li, Xuying Ning +11Recommender SystemsLong-Horizon LLM Agents

  6. Procedural Graphs: Self-Evolving Execution Structures for LLM Agents

    Sep 8, 2026Yuxing Lu, Yicheng Chen, Shanchan Wu +1Graph-Based Agent MemoryLong-Horizon LLM Agents

  7. MeClear: Cooperative Game-Theoretic Attribution and Risk-Aware Memory Clearance for Long-Horizon LLM Agents

    Sep 8, 2026Boyu Yang, Jiazheng Sun, Zilong Lu +3Knowledge Conflicts in Language ModelsLong-Horizon LLM Agents

  8. MEMO: Multimodal Evidence Memory Organization for Long-Horizon LLM Agents

    Sep 7, 2026Xian Gao, Jinpeng Wang, Jiacheng Ruan +3Multimodal MemoryLong-Horizon LLM Agents

  9. Staying on the Attack Path: Structured State for Long-Horizon Automated Penetration Testing

    Sep 7, 2026Weizhe Wang, Yitong Zhang, Yao Zhang +4LLM Agent MemoryLLM Agent Security

  10. Elastic Horizon: Discovering the Effective Interaction Frontier in Agentic Reinforcement Learning

    Sep 7, 2026Gangyi Zhang, Junjie Meng, Letian Zhang +6Agentic RLCurriculum RL

  11. Environment Evolution for Terminal Agents

    Sep 3, 2026Zhiyuan Fan, Tinghao Yu, Yuanjun Cai +9Terminal AgentsCurriculum RL

  12. Act More, Decide Less: Skill-Guided Adaptive Action Chunking for Long-Horizon LLM Agents

    Sep 2, 2026Yanting Yang, Can Jin, Jinman Zhao +6LLM Agent Workflow OptimizationLLM Agent Skill Learning

  13. Harness-of-Harness: Multi-Day Autonomous Software Development with Continual Improvement

    Sep 1, 2026Haoyang Yan, Min-le Su, Hangfan Zhang +6Agent Harness OptimizationSelf-Improving Agents

  14. WorldBench: Culturally Grounded Benchmark for Multilingual Agents

    Sep 1, 2026Leonardo Ranaldi, Sherrie Shen, Jushi Kai +1Cross-Cultural Language Model EvaluationLLM Agent Evaluation

  15. Polished but Unresolved: Identifying Late-Stage Pressure States in Long-Horizon Tool-Use Agents

    Sep 1, 2026Haoyang Chen, Yi Liu, Jianzhi Shao +3LLM AgentsLong-Horizon LLM Agents

  16. ContextPipe: Database-Inspired Context Assembly for Long-Horizon Agents

    Sep 1, 2026Peng Xu, Zuyu Zhang, Yuze Sun +3LLM Inference EfficiencyLong-Horizon LLM Agents

  17. Towards a Belief-Based World Model for LLM Agents

    Aug 31, 2026Shubham Kumar, Harshit Kumar, Narendra Ahuja +1Belief-Space PlanningPartially Observable RL

  18. HiRS-Agent: A Hierarchical Multi-Agent System for Reliable Long-Horizon Remote Sensing Task Solving

    Aug 31, 2026Boyang Mu, Zhiwei Wei, Mugen Peng +1Multi-Agent CollaborationRemote Sensing

  19. Geometry of Divergence: Tracking Hidden-State Trajectories for Adaptive Multi-Turn Reasoning

    Aug 31, 2026Jie Liang, Zhengxin Yu, Hamid Nasiri +1Long-Horizon LLM AgentsRepresentation Geometry in Language Models

  20. Agents in the Large: Perception-Centered Architecture for Persistent Agents

    Aug 31, 2026Shihan Dou, Haoxiang Jia, Shichun Liu +14Cognitive Architectures for AI AgentsLifelong Learning Agents

  21. CAST: Critique-Aware Supervision for Training Reliable Long-Horizon Tool-Calling Agents

    Aug 31, 2026Amir Saeidi, Zehua Zhang, Rishitosh Singh +6LLM AgentsLLM Agent Training

  22. When History Is Multimodal: Rethinking Context Management for Long-Horizon Agents

    Aug 30, 2026Jiaqi Su, Cong Pang, Jiawei Hong +4Multimodal MemoryLong-Horizon LLM Agents

  23. AgenticRag-R1: Agentic Reinforcement Learning with Stack Memory for Multi-Step Reasoning, Retrieval and Memorizing

    Aug 30, 2026Xinke Jiang, Yue Fang, Zhibang Yang +12Retrieval-Augmented GenerationAgentic RAG

  24. CineForge: Self-Improving Agents for Long-Horizon Video Generation

    Aug 30, 2026Junxiang Liu, Lin Wang, Haiyu Shi +10Long-Horizon Video GenerationAgentic Video Generation

  25. SKILL.state: Scalable Long-Horizon Agent Skills

    Aug 26, 2026Sanket Badhe, Priyanka Tiwari, Jonghyun ChungLong-Horizon Agent TasksLong-Horizon LLM Agents