Long-Horizon Agent Tasks

Latest papers 127

All topics
CardsList
  1. Momento: Evaluating Persistent Memory and Reasoning with Multi-Session Agentic Conversations

    May 30, 2026Adril Putra Merin, David Anugraha, Ayu Purwarianti +1Agent MemoryTemporal Reasoning

  2. Learning Agent-Compatible Context Management for Long-Horizon Tasks

    May 29, 2026Lu Yi, Runlin Lei, Liuyi Yao +6Long-Horizon Agent TasksLLM Context Management

  3. LongDS-Bench: On the Failure of Long-Horizon Agentic Data Analysis

    May 28, 2026Kewei Xu, Xiaoben Lu, Shuofei Qiao +4Long-Horizon Agent EvaluationLong-Horizon Agent Tasks

  4. Evolve as a Team: Collaborative Self-Evolution for LLM-based Multi-Agent Systems

    May 28, 2026Zhezheng Hao, Tianfu Wang, Huanshuo Dong +7Multi-Agent System OptimizationMulti-Agent Coordination

  5. GTA: Generating Long-Horizon Tasks for Web Agents at Scale

    May 28, 2026Tenghao Huang, Kung-Hsiang Huang, Prafulla Kumar Choubey +4Computer-Use Agent BenchmarksWeb Agent Benchmarks

  6. ForestHG-Trace: Traceable Long-Horizon Ecological Reasoning over Large-Scale Forest Scenes

    May 26, 2026Zihang Cheng, Duanchu Wang, Cheng Li +3Remote Sensing VQATool-Using Vision-Language Agents

  7. Completion vs Optimality: Policy Gradient in Long-Horizon Cumulative-Damage Problems

    May 26, 2026Wolfgang Maass, Sabine JanzenPolicy GradientProximal Policy Optimization

  8. SAM: State-Adaptive Memory for Long-Horizon Reasoning Agent

    May 23, 2026Yuyang Hu, Hongjin Qian, Shuting Wang +5Long-Horizon Agent TasksAgent Memory Management

  9. Toward AI VIS Co-Scientists: A General and End-to-End Agent Harness for Solving Complex Data Visualization Tasks

    May 20, 2026Haichao Miao, Zhimin Li, Kuangshi Ai +4Scientific VisualizationData Visualization

  10. ContextFlow: Hierarchical Task-State Alignment for Long-Horizon Embodied Agents

    May 19, 2026Shuhan Guo, Kun Zhang, Haifei Liu +4Long-Horizon Agent TasksEmbodied AI

  11. MementoGUI: Learning Agentic Multimodal Memory Control for Long-Horizon GUI Agents

    May 18, 2026Ziyun Zeng, Hang Hua, Bocheng Zou +3Multimodal MemoryGUI Agents

  12. SPIKE: An Adaptive Dual Controller Framework for Cost-Efficient Long-Horizon Game Agents

    May 18, 2026Wencan Jiang, Jiangning Zhang, Jianbiao Mei +6Game-Playing AgentsFeedback Control

  13. RoadmapBench: Evaluating Long-Horizon Agentic Software Development Across Version Upgrades

    May 15, 2026Xinbo Xu, Ruihan Yang, Haiyang Shen +13AI Coding AgentsSoftware Engineering Benchmarks

  14. ASH: Agents that Self-Hone in Long-Horizon Worlds

    May 14, 2026Benjamin Schneider, Xavier Schneider, Victor Zhong +1Game-Playing AgentsSelf-Improving Agents

  15. Harnessing Agentic Evolution

    May 13, 2026Jiayi Zhang, Yongfeng Gu, Jianhao Ruan +10Evolutionary OptimizationSelf-Improving Agents

  16. ReVision: Scaling Computer-Use Agents via Temporal Visual Redundancy Reduction

    May 11, 2026Amirhossein Abaskohi, Yuhang He, Peter West +3Computer-Use AgentsLong-Horizon Agent Tasks

  17. Zero-shot Imitation Learning by Latent Topology Mapping

    May 8, 2026Maxwell J. Jacobson, Yexiang XueImitation LearningLong-Horizon Agent Tasks

  18. WebTrap: Stealthy Mid-Task Hijacking of Browser Agents During Navigation

    May 8, 2026Zhichao Liu, Wenbo Pan, Haining Yu +3Indirect Prompt InjectionPrompt Injection Attacks

  19. Milestone-Guided Policy Learning for Long-Horizon Language Agents

    May 7, 2026Zixuan Wang, Yuchen Yan, Hongxing Li +7Credit Assignment in RLLong-Horizon Agent Tasks

  20. On Training Large Language Models for Long-Horizon Tasks: An Empirical Study of Horizon Length

    May 4, 2026Sunghwan Kim, Junhee Cho, Beong-woo Kwak +6Long-Horizon PlanningLength Generalization

  21. Lifting Traces to Logic: Programmatic Skill Induction with Neuro-Symbolic Learning for Long-Horizon Agentic Tasks

    May 2, 2026Jie-Jing Shao, Haiyan Yin, Yueming Lyu +5Program SynthesisLLM Agent Skill Learning

  22. Step-level Optimization for Efficient Computer-use Agents

    Apr 29, 2026Jinbiao Wei, Kangqi Ni, Yilun Zhao +2Computer-Use AgentsAI Agent Monitoring

  23. ADEMA: A Knowledge-State Orchestration Architecture for Long-Horizon Knowledge Synthesis with LLMAgents

    Apr 28, 2026Zhou Hanlin, Chan Huah YongLLM Agent MemoryLLM Agent Orchestration

  24. Odysseys: Benchmarking Web Agents on Realistic Long Horizon Tasks

    Apr 27, 2026Lawrence Keunho Jang, Jing Yu Koh, Daniel Fried +1Computer-Use Agent BenchmarksWeb Agent Benchmarks

  25. From Coarse to Fine: Self-Adaptive Hierarchical Planning for LLM Agents

    Apr 25, 2026Haoran Tan, Zeyu Zhang, Chen Ma +3Hierarchical PlanningLong-Horizon Agent Tasks

  26. SOLAR-RL: Semi-Online Long-horizon Assignment Reinforcement Learning

    Apr 24, 2026Jichao Wang, Liuyang Bian, Yufeng Zhou +9RL for GUI AgentsCredit Assignment in RL

  27. ALAS: Adaptive Long-Horizon Action Synthesis via Async-pathway Stream Disentanglement

    Apr 22, 2026Yutong Shen, Hangxu Liu, Lei Zhang +4Disentangled Representation LearningCross-Domain Transfer Learning

  28. A Self-Evolving Framework for Efficient Terminal Agents via Observational Context Compression

    Apr 21, 2026Jincheng Ren, Siwei Wu, Yizhi Li +8Terminal AgentsLong-Horizon Agent Tasks

  29. Gated Coordination for Efficient Multi-Agent Collaboration in Minecraft Game

    Apr 21, 2026HuaDong Jian, Chenghao Li, Haoyu Wang +4Multi-Agent LLM SystemsMulti-Agent Collaboration