Long-Horizon Agent Tasks

Latest papers 127

All topics
CardsList
  1. SCOUT: Self-Checking and Recovery-Aware Tool-Thought Agents for Ultra-Long Egocentric Video Reasoning

    Aug 8, 2026Keyang Zhong, Kuo Wang, Peng Liu +5Temporal Video GroundingGroup Relative Policy Optimization

  2. MemPrism: Task-Conditioned Relational Memory Views for Long-Horizon Agents

    Aug 7, 2026Zhisheng Chen, Bingfan Zeng, Bangde Cao +8Long-Horizon Agent TasksMemory-Augmented Agents

  3. Online Monitoring and Corrective Steering of Programming Agents

    Aug 7, 2026Shuyang Liu, Saman Dehghan, Ji Young Kim +3Software Engineering AgentsLLM Agent Workflow Optimization

  4. Recursive Synthesis for Long-Horizon Terminal Tasks

    Aug 5, 2026Zhongzhi Li, Yucheng Shi, Zongxia Li +8Terminal AgentsSynthetic Benchmark Generation

  5. EvoHarness-RL: Learning Runtime Harness Coordination for Self-Evolving Agents

    Aug 5, 2026Xuying Ning, Dongqi Fu, Tianxin Wei +17Agent Harness OptimizationLong-Horizon Agent Tasks

  6. Project2Task: Graph-Guided Project-Level Planning for Autonomous Research

    Aug 5, 2026Huirui Xu, Runtao Xu, Shuo Ren +1AI Agents for Scientific DiscoveryGraph-Based Planning

  7. Towards the Harness of Embodied Agents

    Aug 3, 2026Qi Wang, Tianyi Wang, Chengyang Li +6Tool-Using AgentsLong-Horizon Agent Tasks

  8. From Failures to Supervision: DynamicEnvPlan for Robust Long-Horizon Embodied Planning

    Aug 1, 2026Hao Yuan, Yuxin Wang, Lei Ji +1Robot Failure RecoveryRobot Task Planning

  9. Leveraging Trajectory Graphs for Pre-Execution Error Diagnosis in Agentic LLM Systems

    Jul 29, 2026Xu Zheng, Zhuomin Chen, Chaohao Lin +4Long-Horizon Agent TasksLong-Horizon LLM Agents

  10. OmegaUse-OfficeVal: Benchmarking LLM Agents on Long-Horizon Office-Suite Tasks with Economic Grounding

    Jul 29, 2026Jingbo Zhou, Yusai Zhao, Qi Bao +12Computer-Use Agent BenchmarksComputer-Use Agents

  11. AgentGUI: An Interface for Observing and Steering Long-Running AI Agents

    Jul 28, 2026Xuan Zhao, Jiwoong Sohn, Qinyue Zheng +1GUI AgentsHuman-in-the-Loop AI

  12. ODYSSE: Episode-wise Policy Optimization for Personalized Agentic Reasoning

    Jul 28, 2026Jiaqi Zhang, Tong Chen, Junliang Yu +2Group Relative Policy OptimizationAgentic Reasoning

  13. Matryoshka Agent: Unfolding Sub-Agents for Long-Horizon Machine Learning Engineering

    Jul 27, 2026Rushi Qiang, Changhao Li, Haotian Sun +3LLM Agent OrchestrationLLM Agents

  14. ACM: Agentic Context Management for Long Horizon Tasks

    Jul 26, 2026Xiaochuan Li, Ryan Ming, Meng Chu +3LLM Agent TrainingLong-Horizon Agent Tasks

  15. VoLN: Vision-Only Long-Horizon Navigation---Paradigm, Benchmark, and Method

    Jul 23, 2026Jiabin Lou, Haopeng Wang, Yuanshuai Wang +6Embodied NavigationRobot Navigation

  16. Offline RL with Hierarchical Action Chunking

    Jul 23, 2026Ahad JawaidHierarchical RLOffline RL

  17. Progress-conditioned Group Policy Optimization for Long-Horizon Agentic Tasks

    Jul 22, 2026Kaibing Yang, Guangfeng Cai, Shengtian Yang +6Group Relative Policy OptimizationRL Exploration

  18. SEE: Structure-aware Exploring & Exploiting for Long-horizon GUI Agent Trajectory Synthesis

    Jul 20, 2026Zhuohang Fan, Beichen Zhang, Yuanfa Li +4Trajectory GenerationSynthetic Data Generation

  19. Beyond Sequential Interaction: Benchmarking Parallel Execution and Coordination for GUI Agents

    Jul 17, 2026Zedong Yu, Qianxing Li, Zhi Gao +8Computer-Use Agent BenchmarksGUI Agents

  20. ToolVerse: Unlocking Massive Environments and Long-Horizon Tasks for Agentic Reinforcement Learning

    Jul 17, 2026Shuaiyu Zhou, Fengpeng Yue, Zengjie Hu +5Tool-Use EvaluationAgentic RL

  21. Just-In-Time Scene Graph Growth: Combating Perceptual Saturation in Long-Horizon Robotics

    Jul 14, 2026Yue Chang, Rufeng Chen, Yifan Tian +73D SGGLong-Horizon Agent Tasks