Long-Horizon LLM Agents

LLM: Large Language Model

Momentum

60 papers in the last four weeks, up 161% on the four weeks before. 0.6% of all new papers.

Jul 13Week of Sep 28

Latest papers 297

All topics
CardsList
  1. HarnessBridge: Learnable Bidirectional Controller for LLM Agent Harness

    Jun 11, 2026Xiaoxuan Wang, Haixin Wang, Alexander Taylor +3Agent Harness OptimizationLLM Agent Training

  2. WISE: A Long-Horizon Agent in Minecraft with Why-Which Reasoning

    Jun 11, 2026Renmin Cheng, Changhao ChenCausal ReasoningLong-Horizon Agent Tasks

  3. Toward Generalist Autonomous Research via Hypothesis-Tree Refinement

    Jun 10, 2026Jiajie Jin, Yuyang Hu, Kai Qiu +15Long-Horizon LLM AgentsAutonomous Experimentation

  4. ISE: An Execution-Grounded Recipe for Multi-Turn OS-Agent Trajectories

    Jun 9, 2026Siyuan Luo, Nairong Zheng, Lin Zhou +6Synthetic Data GenerationTool-Using Agents

  5. Learning What to Remember: Observability-Safe Memory Retention via Constrained Optimization for Long-Horizon Language Agents

    Jun 9, 2026Qingcan Kang, Liu Mingyang, Shixiong Kai +3Stochastic OptimizationLong-Horizon LLM Agents

  6. ActiveMem: Distributed Active Memory for Long-Horizon LLM Reasoning

    Jun 9, 2026Yunhan Jiang, Wenbin Duan, Shasha Guo +3Long-Horizon LLM AgentsAgent Memory Management

  7. HIPIF: Hierarchical Planning and Information Folding for Long-Horizon LLM Agent Learning

    Jun 9, 2026Juncheng Diao, Zhicong Lu, Peiguang Li +6Hierarchical RLLong-Horizon LLM Agents

  8. SearchSwarm: Towards Delegation Intelligence in Agentic LLMs for Long-Horizon Deep Research

    Jun 8, 2026Pu Ning, Quan Chen, Kun Tao +7Multi-Agent LLM SystemsLLM Agent Orchestration

  9. Can the Environment Speak for Itself? T2T^{2}-GRPO: A Turn-Trajectory Group Relative Policy Optimization for Caregiver Agents

    Jun 7, 2026Yutong Song, Jiang Wu, Pengfei Zhang +4Reward ShapingHealthcare

  10. Benchmarking Open-Ended Multi-Agent Coordination in Language Agents

    Jun 6, 2026Kale-ab Abebe Tessera, Andras Szecsenyi, Cameron Barker +7Multi-Agent CoordinationLLM Agent Evaluation

  11. To Nuke or Not to Nuke: LLMs' (Missing) Ethical Reasoning and Actions in a High-Stakes Decision-Making Simulation

    Jun 6, 2026John Chen, Sihan Cheng, Can Gurkan +1Moral Reasoning in Language ModelsLLM Agent Evaluation

  12. IntentKV: Cross-Turn Intent-Aware KV Cache Pruning for Agent Inference

    Jun 6, 2026Junjie Li, Jiong Lou, Jie LiKV CachingKV-Cache Management

  13. Agentopia: Long-Term Life Simulation and Learning in Agent Societies

    Jun 5, 2026Xintao Wang, Sirui Zheng, Hongqiu Wu +10Multi-Agent LLM SystemsHuman Behavior Simulation

  14. Signal-Driven Observation for Long-Horizon Web Agents

    Jun 4, 2026Shubham Gaur, Ian LaneActive PerceptionLong-Horizon LLM Agents

  15. Agent Memory: Characterization and System Implications of Stateful Long-Horizon Workloads

    Jun 4, 2026Yasmine Omri, Ziyu Gan, Zachary Broveak +6Agent MemoryLLM Agent Memory

  16. Beyond Semantic Organization: Memory as Execution State Management for Long-Horizon Agents

    Jun 4, 2026Yaoqi Chen, Haibin Lai, Yuru Feng +12Agent MemoryLong-Horizon LLM Agents

  17. Evolving Agents in the Dark: Retrospective Harness Optimization via Self-Preference

    Jun 4, 2026Wenbo Pan, Shujie Liu, Chin-Yew Lin +5Software Engineering AgentsAgent Harness Optimization

  18. AdaMEM: Test-Time Adaptive Memory for Language Agents

    Jun 4, 2026Yunxiang Zhang, Yiheng Li, Ali Payani +1Agent MemoryTest-Time Adaptation

  19. Personal AI Agent for Camera Roll VQA

    Jun 3, 2026Thao Nguyen, Krishna Kumar Singh, Donghyun Kim +2Visual Question AnsweringLong-Horizon LLM Agents

  20. Multi2^2: Hierarchical Multi-Agent Decision-Making with LLM-Based Agents in Interactive Environments

    Jun 2, 2026Sangeun Park, Minhae KwonMulti-Agent LLM SystemsHierarchical RL

  21. MemTrain: Self-Supervised Context Memory Training

    Jun 2, 2026Ziheng Li, Xingrun Xing, Haoqing Wang +2LLM Agent MemoryPersistent Memory for Language Models

  22. WRIT: Write-Read Intensive Trajectory Synthesis for Multi-Turn User-Facing Agents

    Jun 1, 2026Hengrui Gu, Xiaotian Han, Kaixiong ZhouTool-Augmented Language Model AgentsTool-Using Agents

  23. CoMAP: Co-Evolving World Models and Agent Policies for LLM Agents

    Jun 1, 2026Youwei Liu, Jian Wang, Hanlin Wang +1LLM World ModelsLLM Agent Training

  24. SIRI: Self-Internalizing Reinforcement Learning with Intrinsic Skills for LLM Agent Training

    Jun 1, 2026Zhongyu He, Yuanfan Li, Fei Huang +9LLM Agent Skill LearningLong-Horizon LLM Agents

  25. SkillAdaptor: Self-Adapting Skills for LLM Agents from Trajectories

    May 31, 2026Zhuoyun Yu, Xin Xie, Wuguannan Yao +4LLM Agent Skill LearningLong-Horizon LLM Agents

  26. CoMIC: Collaborative Memory and Insights Circulation for Long-Horizon LLM Agents in Cloud-Edge Systems

    May 30, 2026Yannan Wang, Longli Yang, Zhen Liu +2LLM Agent MemoryEdge Computing