Single-Agent Baselines

Momentum

1 paper in the last four weeks, down 80% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 45

All topics
CardsList
  1. TRACE: Governing Memory Validity in Evolving Multi-Agent Systems

    Sep 27, 2026Wenjun Xiong, Shengtao Zhang, Shangding Gu +5TracesSingle-Agent Baselines

  2. Air-Ground Collaborative Vision-and-Language Navigation via Shared Bird's-Eye Maps

    Sep 3, 2026Shuning Zhang, Liang Li, Yunheng Wang +3Aerial Vision-Language NavigationCooperative Air Combat

  3. GenScale: A Benchmark for Relative Object Scale in Image Generation and Editing

    Sep 1, 2026Lingxiao Li, Max Whitton, Ledell Wu +1Image GenerationIndoor Scene Generation

  4. Lines and Ladders: A Context-Aware Multi-Agent Framework for Large-Scale Retail Price Taxonomy

    Aug 13, 2026Ravi Teja Chunduri, Srikaran Reddy Boya, Deep Narayan Mishra +3TaxonomySingle-Agent Baselines

  5. Social Chain of Thought: A Multi-Agent Architecture Grounded in Medical Differential Diagnosis Methodology

    Aug 11, 2026Del Coburn, Scott Sanner, Dan SilverDiagnosisDeliberation

  6. DSLE: A Learning Environment for Dark Souls Boss Encounters

    Aug 10, 2026Derin Gezgin, Jim O'Connor, Tanner Goodwin +1Deep Q-NetworksSingle-Agent Baselines

  7. Blast Radius

    Aug 7, 2026MY Pitsane, Hope MogaleCoding AgentsSingle-Agent Baselines

  8. Contextual Value Alignment via Multilayer Combinatorial Fusion

    Aug 7, 2026Yuanhong Wu, Djallel Bouneffouf, D. Frank HsuMulti-Agent ReasoningSingle-Agent Baselines

  9. Stateful Governance for Concurrent Agentic Systems

    Aug 3, 2026Yuxiang Peng, Xiaodi WuGovernanceProduction Agentic Systems

  10. The Cost of Knowing: A Resource-Aware Protocol for Benchmarking Hallucination Beyond Static Leaderboards

    Jul 27, 2026Keyu Li, Jin Gao, Dequan WangLeaderboardFacts

  11. AgentOmnia: Scaling Agentic Models for Full-Scenario Applications

    Jul 25, 2026Hao Jiang, Gangtao Xin, Yingdi Huang +35Agentic FrameworkSingle-Agent Baselines

  12. Knowledge-Centric Self-Improvement

    Jul 21, 2026Xuefei Julie Wang, Lauren Hyoseo Yoon, Chengrui Qu +4Self-Improving AgentsRecursive Self-Improvement

  13. SCATE: Learning to Supervise Coding Agents for Cost-Effective Test Generation

    Jul 9, 2026Sijia Gu, Noor Nashid, Ali MesbahTest GenerationCoding Agents

  14. A hierarchical memory architecture overcomes context limits in long-horizon multi-agent computational modeling

    Jul 8, 2026Shivendra G. Tewari, Holly KimkoLong-Term Agent MemorySingle-Agent Baselines

  15. Does AI Understand Imaging? A Systematic Benchmark of Agentic AI for Computational Imaging Tasks

    Jul 8, 2026Ethan Chung, Chuanjun Zheng, Jasper Tan +3Multi-Image Editing BenchmarksMultimodal Benchmarks

  16. SelfMem: Self-Optimizing Memory for AI Agents

    Jul 4, 2026Shu Yang, Junchao Wu, Derek F. Wong +1Self-Improving AgentsSemantic Memory

  17. Agent4cs: A Multi-agent System for Code Summarization in Large Hierarchical Codebases

    Jul 1, 2026Yongjian Tang, Ezgi Sarikayak, Doruk Tuncel +2CodebasesCoding Agents

  18. Agentic evolution of physically constrained foundation models

    Jun 24, 2026Jiangwei Zhang, Wen Sun, Chong Wang +7Wireless Foundation ModelsMulti-Agent Evolution

  19. VTOS: Learning to Orchestrate Vision Tools by Co-Searching Solutions and Observers

    Jun 17, 2026Jinchao Ge, Lingqiao Liu, Shuwen Zhao +1Multiple Vision TasksComputer Vision

  20. WEQA: Wearable hEalth Question Answering with Query-Adaptive Agentic Reasoning

    Jun 16, 2026Yuwei Zhang, Tong Xia, Bianca Emmerich +5Wearable DevicesAgentic Reasoning

  21. Agentic Framework for Deep Learning workload migration via In-Context Learning

    Jun 14, 2026Qiyue Liang, Steven Ingram, George Vanica +4PytorchAgentic Framework

  22. Dr-DCI: Scaling Direct Corpus Interaction via Dynamic Workspace Expansion

    Jun 12, 2026Yi Lu, Zhuofeng Li, Ping Nie +7RetrieversText Corpora

  23. Multi2^2: Hierarchical Multi-Agent Decision-Making with LLM-Based Agents in Interactive Environments

    Jun 2, 2026Sangeun Park, Minhae KwonLong-Horizon AgentsSingle-Agent Baselines

  24. Masking Stale Observations Helps Search Agents -- Until It Doesn't: A Regime Map and Its Mechanism

    May 29, 2026Haoxiang Zhang, Qixin Xu, Zhuofeng Li +4Search AgentsSingle-Agent Baselines

  25. Crafter: A Multi-Agent Harness for Editable Scientific Figure Generation from Diverse Inputs

    May 28, 2026Haozhe Zhao, Shuzheng Si, Zhenhailong Wang +6Scientific FigureScalable Vector Graphic

  26. Do Agents Need Semantic Metadata? A Comparative Study in Agentic Data Retrieval

    May 27, 2026Shiyu Chen, Tarfah Alrashed, Alon Halevy +1Data Science AgentsMetadata

  27. Audio-Mind: An Auditable Agentic Framework for Audio Understanding

    May 27, 2026Yucheng Wang, Jing Peng, Hanqi Li +6Audio UnderstandingVoice Agents

  28. GUI Agents for Continual Game Generation

    May 27, 2026Yixu Huang, Bo Li, Na Li +8Motion GenerationGraphical User Interface

  29. Automating Formal Verification with Agent-Guided Tree Search

    May 26, 2026Leo YaoFormal VerificationCode Generation

  30. A measurement substrate for agentic Kubernetes operations: Methodology and a case study in retrieval-compounding falsification

    May 21, 2026Joshua Odmark, Gideon Rubin, Deon van der VyverKubernetesFalsehood

  31. Terminal-World: Scaling Terminal-Agent Environments via Agent Skills

    May 20, 2026Zihao Cheng, Hongru Wang, Zeming Liu +6Synthetic TaskSingle-Agent Baselines

  32. PathoSage: Towards Multi-Source Evidence Adjudication in Pathology via Experience-Aware Agentic Workflow

    May 18, 2026Chengyang Zhang, Wenchuan Zhang, Bo Li +5Pathology Foundation ModelsMultimodal Reasoning

  33. PopuLoRA: Co-Evolving LLM Populations for Reasoning Self-Play

    May 16, 2026Roger Creus Castanyer, Geoffrey Bradway, Lorenz Wolf +3Self-PlaySingle-Agent Baselines

  34. LongMemEval-V2: Evaluating Long-Term Agent Memory Toward Experienced Colleagues

    May 12, 2026Di Wu, Zixiang Ji, Asmi Kawatkar +4Long-Term Agent MemoryLong-Term Memory

  35. OptArgus: A Multi-Agent System to Detect Hallucinations in LLM-based Optimization Modeling

    May 12, 2026Zhong Li, Zihan Guo, Xiaohan Lu +5Optimization ModelingSingle-Agent Baselines

  36. EvoMAS: Learning Execution-Time Workflows for Multi-Agent Systems

    May 9, 2026Chengdong Xu, Kaiqiang Ke, Ziheng Liu +4Multi-Agent WorkflowsMulti-Agent Coordination

  37. Superintelligent Retrieval Agent: The Next Frontier of Agentic Retrieval

    May 7, 2026Zeyu Yang, Qi Ma, Jason Chen +1RetrieversSingle-Agent Baselines

  38. An Empirical Study of Proactive Coding Assistants in Real-World Software Development

    May 7, 2026Lehui Li, Ruixuan Jia, Guo-Ye Yang +1Ai-Assisted Programming TasksUser Simulation

  39. Combining Trained Models in Reinforcement Learning

    May 4, 2026Ujjwal Patil, Javad GhofraniReusable KnowledgeSingle-Agent Baselines

  40. SAFEdit: Does Multi-Agent Decomposition Resolve the Reliability Challenges of Instructed Code Editing?

    Apr 28, 2026Noam Tarshish, Nofar Selouk, Daniel Hodisan +4Single-Agent BaselinesBrainagent

  41. Meta-TTL: Meta-Learning Self-Improvement Policies for Language Agents

    Apr 1, 2026Zhanzhi Lou, Hui Chen, Yibo Li +2Stable Test-Time AdaptationTest-Time Training