Long-Horizon LLM Agents

LLM: Large Language Model

Momentum

60 papers in the last four weeks, up 161% on the four weeks before. 0.6% of all new papers.

Jul 13Week of Sep 28

Latest papers 297

All topics
CardsList
  1. SPADER: Step-wise Peer Advantage with Diversity-Aware Exploration Rewards for Multi-Answer Question Answering

    May 30, 2026Qiming Shi, Zhaolu Kang, Yunfan Zhou +2Credit Assignment in RLStep-Level Credit Assignment in RL

  2. Skill is Not One-Size-Fits-All: Model-Aware Skill Alignment for LLM Agents

    May 29, 2026Jianxiang Yu, Jiapeng Zhu, Bochen Lin +3LLM Agent Skill LearningLLM Agent Skill Retrieval

  3. Meta-Cognitive Memory Policy Optimization for Long-Horizon LLM Agents

    May 28, 2026Ziyan Liu, Zhezheng Hao, Yeqiu Chen +7Long-Horizon LLM AgentsMemory-Augmented Language Model Agents

  4. LiteCoder-Terminal: Scaling Long-Horizon Terminal Environments for Learning Language Agents

    May 28, 2026Xiaoxuan Peng, Kaiqi Zhang, Xinyu Lu +5RL for Language ModelsTerminal Agents

  5. Ask Now, Use Later: Benchmarking the Proactivity Gap in Long-Lived LLM Agents

    May 27, 2026Bin Wu, Guanyun Zou, Bingbing Wang +2LLM Agent MemoryLLM Agent Evaluation

  6. Claw-Anything: Benchmarking Always-On Personal Assistants with Broader Access to User's Digital World

    May 25, 2026Yusong Lin, Xinyuan Liang, Haiyang Wang +8Computer-Use Agent BenchmarksAI Agent Benchmarks

  7. Hera: Learning Long-Horizon Coordination for Device-Cloud Collaborative LLM Agents

    May 23, 2026Yuxin Zhang, Mengxue Hu, Zheng Lin +8LLM Agent TrainingLLM Routing

  8. AgentFugue: Agent Scaling for Long-Horizon Tasks through Collective Reasoning

    May 23, 2026Yuyang Hu, Hongjin Qian, Shuting Wang +5Multi-Agent ReasoningLong-Horizon LLM Agents

  9. An Interactive Paradigm for Deep Research

    May 22, 2026Lin Ai, Victor S. Bursztyn, Xiang Chen +2Deep Research AgentsHuman-in-the-Loop AI

  10. QUEST: Training Frontier Deep Research Agents with Fully Synthetic Tasks

    May 22, 2026Jian Xie, Tianhe Lin, Zilu Wang +16Deep Research AgentsLLM Agent Training

  11. Parallel Context Compaction for Long-Horizon LLM Agent Serving

    May 22, 2026Musa Cim, Burak Topcu, Chita Das +1LLM Inference EfficiencyLLM Agent Workflow Optimization

  12. IdleSpec: Exploiting Idle Time via Speculative Planning for LLM Agents

    May 21, 2026Daewon Choi, Kyunghyun Park, Woomin Song +4LLM Inference EfficiencyLong-Horizon LLM Agents

  13. ExComm: Exploration-Stage Communication for Error-Resilient Agentic Test-Time Scaling

    May 21, 2026Woomin Song, Beomjun Kim, Daewon Choi +4Test-Time ScalingMulti-Agent Systems

  14. Memory-R2: Fair Credit Assignment for Long-Horizon Memory-Augmented LLM Agents

    May 20, 2026Sikuan Yan, Ahmed Bahloul, Ercong Nie +4Group Relative Policy OptimizationCredit Assignment in RL

  15. SMDD-Bench: Can LLMs Solve Real-World Small Molecule Drug Design Tasks?

    May 20, 2026Kevin Han, Renfei Zhang, Kathy Wei +3LLM Agent EvaluationAI Agent Benchmarks

  16. APEX: Autonomous Policy Exploration for Self-Evolving LLM Agents

    May 20, 2026Yibo Li, Jiashuo Yang, Zhi Zheng +5LLM AgentsLong-Horizon LLM Agents

  17. MemGym: a Long-Horizon Memory Environment for LLM Agents

    May 20, 2026Wujiang Xu, Yu Wang, Kai Mei +8LLM Agent MemoryLLM Agent Evaluation

  18. A Methodology for Selecting and Composing Runtime Architecture Patterns for Production LLM Agents

    May 19, 2026Vasundra SrinivasanLLM Agent OrchestrationLLM Agents

  19. STAR-PólyaMath: Multi-Agent Reasoning under Persistent Meta-Strategic Supervision

    May 19, 2026Jiaao Wu, Xian Zhang, Hanzhang Liu +3Multi-Agent OrchestrationMulti-Agent Reasoning

  20. Code as Agent Harness

    May 18, 2026Xuying Ning, Katherine Tieu, Dongqi Fu +39LLM Agent OrchestrationLong-Horizon LLM Agents

  21. Latent Action Reparameterization for Efficient Agent Inference

    May 18, 2026Wenhao Huang, Qingwen Zeng, Qiyue Chen +11LLM Inference EfficiencyLatent Action Learning

  22. Harnessing LLM Agents with Skill Programs

    May 18, 2026Hongjun Liu, Yifei Ming, Shafiq Joty +1LLM Agent Self-ImprovementLLM Agent Skill Learning

  23. Causal Intervention-Based Memory Selection for Long-Horizon LLM Agents

    May 17, 2026Saksham Sahai SrivastavaConversational MemoryLong-Term Conversational Memory