Single-Agent

Momentum

3 papers in the last four weeks, level with the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 34

All topics
CardsList
  1. It Takes Workflows to Evolve Better Workflows

    Oct 1, 2026Xuehang Guo, Haoyu Wang, Haifeng Chen +3Agentic Workflow DesignAi-Assisted Writing

  2. OpenCollab: A Multi-Agent Coding Framework with Programmable Collaboration and Controllable Runtime

    Sep 29, 2026Chun-Wah Hsu, Kai Gong, Yu Wu +12CollaborationCoding Agents

  3. VehicleArena: A Realistic Urban Environment for Multi-Agent Driving

    Sep 28, 2026Jie Yang, Jiajun Chen, Jiazheng Zhou +4Microscopic Traffic SimulationsMulti-Agent Simulations

  4. A Case Study on Emergent Cheating and Whistleblowing in Autonomous Research Swarms

    Sep 3, 2026Davide Paglieri, Logan Cross, Tim Genewein +3SwarmsSingle-Agent

  5. NashDreamer: Model-Based Reinforcement Learning for Zero-Sum Imperfect-Information Games

    Sep 1, 2026Tomáš Holeček, Viliam LisýImperfect-Information GamesModel-Based Reinforcement Learning

  6. Is Per-Agent Policy Composition Safe? Rethinking Successor-Feature Transfer in Cooperative Multi-Agent Reinforcement Learning

    Aug 12, 2026Zijian Zhao, Sen LiMulti-Agent Reinforcement LearningSuccessor Representations

  7. The Bitter Lesson of Tool Calling

    Aug 6, 2026Ishan Patel, Sahil Sen, Elias Lumer +1Large Language Model Tool UseKeyed Javascript Object Notation Record Yields

  8. Securing Agentic AI: From Per-Action Checks to Trajectory Assurance

    Aug 3, 2026Alireza Lotfi, Subangkar Karmaker Shanto, Imtiaz Karim +1Agentic DeploymentsDelegation

  9. When Prompts Control Robots: Prompt Injection Attacks in Multi-Agent Robotic Systems

    Aug 1, 2026Neha Nagaraja, Amisha Bagari, Hayretdin BahsiIndirect Prompt InjectionMulti-Robot Systems

  10. AgentRadio: Passive Awareness for Long-Horizon Multi-Agent Collaboration

    Jul 30, 2026Xinxing Ren, Qianbo Zang, Ziyan Wang +4Coding AgentsCollaboration

  11. Collusion with Competitive Marginals: Price-Level Audits Are Blind by Construction

    Jul 29, 2026Xin Xu, Chengrui Wu, Jiayu Lu +3CollusionBidding

  12. Early Detection of Distributed Backdoors in Multi-Agent LLM Systems: A Characterization Study

    Jul 27, 2026Diego Fernandez Arias, Dev Prashant Mistry, Ren Wang +1Multi-Agent Large Language Model SystemsClean Label Backdoor Attack

  13. Comparative Study of Multi-Agent Actor-Critic Algorithms in Parameterized Action Reinforcement Learning

    Jul 21, 2026Ubayd Ali Bapoo, Clement N NyirendaMulti-Agent Reinforcement LearningSoft Actor-Critic

  14. Multi-Agent AI Control: Distributed Attacks Hamper Per-Instance Monitors

    Jul 8, 2026Oliver Makins, Orazio Angelini, Zohreh Shams +1Artificial Intelligence ControlSingle-Agent

  15. Low Variance Trust Region Optimization with Independent Actors and Sequential Updates in Cooperative Multi-agent Reinforcement Learning

    Jun 24, 2026Bang Giang Le, Viet Cuong TaMulti-Agent Reinforcement LearningTrust Region

  16. Escaping the Self-Confirmation Trap: An Execute-Distill-Verify Paradigm for Agentic Experience Learning

    Jun 23, 2026Shiding Zhu, Yudi Qi, Yajie Wang +6Agentic LearningSingle-Agent

  17. MAS-PromptBench: When Does Prompt Optimization Improve Multi-Agent LLM Systems?

    Jun 22, 2026Juyang Bai, Laixi ShiMulti-Agent CommunicationMulti-Agent Large Language Model Systems

  18. From Argument Components to Graphs: A Multi-Agent Debate with Confidence Gating for Argument Relations

    Jun 14, 2026Jakub Bąba, Jarosław A. ChudziakMulti-Agent DebateDebate

  19. How Task Structure Limits Multi-Agent Success: An Information-Theoretic Analysis

    Jun 11, 2026Shi Pan, Ming LuoModel-Based Multi-Agent SystemsSingle-Agent

  20. OmniGameArena: A Unified UE5 Benchmark for VLM Game Agents with Improvement Dynamics

    Jun 8, 2026Mingxian Lin, Shengju Qian, Yuqi Liu +9Agentic BenchmarksWebarena Domains

  21. Token Budgets: An Empirical Catalog of 63 LLM-Agent Budget-Overrun Incidents, with an Affine-Typed Rust Mitigation as a Case Study

    Jun 2, 2026Sajjad KhanToken Budget AllocationAgentic Deployments

  22. Dynamic Coordination Strategy Selection for Enterprise Multi-Agent Systems

    May 30, 2026Thanh Luong TuanAdaptive CoordinationGlobal Coordination

  23. A Tight Theory of Error Feedback Algorithms in Distributed Optimization

    May 29, 2026Daniel Berg Thomsen, Adrien Taylor, Aymeric DieuleveutDecentralized OptimizationConvergence

  24. Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork

    May 23, 2026Yuheng Jing, Kai Li, Ziwen Zhang +8Single-AgentLarge-Scale Benchmark

  25. Ratchet: A Minimal Hygiene Recipe for Self-Evolving LLM Agents

    May 21, 2026Xing Zhang, Yanwei Cui, Guanghui Wang +4Self-Evolving Skill LibrariesLarge Language Model Agents

  26. SAS: Semantic-aware Sampling for Generative Dataset Distillation

    May 18, 2026Mingzhuo Li, Guang Li, Linfeng Ye +4Diffusion-Based Dataset DistillationDataset Distillation

  27. MDrive: Benchmarking Closed-Loop Cooperative Driving for End-to-End Multi-agent Systems

    May 11, 2026Marco Coscoy, Zewei Zhou, Seth Z. Zhao +9V2XAutonomous Driving Simulation

  28. Recursive Agent Optimization

    May 7, 2026Apurva Gandhi, Satyaki Chakraborty, Xiangjun Wang +2Agentic OptimizationSingle-Agent

  29. Architecture Matters for Multi-Agent Security

    Apr 25, 2026Ben Hagag, William L. Anderson, Christian Schroeder de Witt +1Multi-Agent CommunicationSecurity