LLM Agent Harnesses

LLM: Large Language Model

Momentum

49 papers in the last four weeks, up 88% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 198

All topics
CardsList
  1. Learning Meta-Skills for Agent Harness Design in Test-Time AI4AI

    Sep 29, 2026Cheng Qian, Kunlun Zhu, Beibin Li +2Agent Harness OptimizationLLM Agent Skill Learning

  2. AnthroDial: Benchmarking LLM Anthropomorphism in Autonomous Social Interaction

    Sep 29, 2026Wentao Liu, Xi Chen, Siyu Song +13LLM Agent EvaluationLLM Agent Training

  3. Distilling Agentic Systems: A Roadmap across Models, Artifacts, and Harnesses

    Sep 29, 2026Ziluowen Luo, Senzhang Wang, Chaozhuo Li +9AI Agent EvaluationKnowledge Distillation

  4. SRHarness: A Harness for Agentic Symbolic Regression

    Sep 28, 2026Zihan Yu, Shixuan Zhou, Hao Huang +2Long-Horizon LLM AgentsLarge Language Model-Guided Scientific Discovery

  5. LLMs are General Asynchronous Agents

    Sep 28, 2026George Yakushev, Denis Mazur, Vladimir Bartenev +4LLM AgentsLLM Agent Harnesses

  6. Planarian: Managing Agent State with Statepoints

    Sep 28, 2026Jinnan Guo, Hao Mark Chen, Kapil Vaswani +2LLM AgentsState Tracking

  7. Towards Reliable AI Data Scientists: Data Agents with Workflow Harnesses

    Sep 28, 2026Huachi Zhou, Yujing Zhang, Jiahe Du +7LLM Agent HarnessesLLM Agent Reliability

  8. NavHarness: Towards Lifelong Embodied Navigation

    Sep 28, 2026Xunyi Zhao, Jian Zhou, Sihao Lin +6Embodied NavigationMemory-Augmented Agents

  9. Vestrum: Improving Agent Harnesses by Adapting Their Verification, Structure and Memory

    Sep 27, 2026Jayant Parashar, Eugene F. Douglass, William C. Bastian +1LLM Agent MemoryAgent Harness Optimization

  10. Compositional Safety Failures in Harness Evolution: Identification and Runtime Monitoring

    Sep 27, 2026Zhixiang Zhang, Zesen Liu, Wai Ip Lai +2Runtime Enforcement for AI AgentsLLM Agent Harnesses

  11. Who Holds the Pen? Let Specifications, Not Agents, Sign Off

    Sep 24, 2026Haiqing Li, Xin Ma, Yinhao Wu +7LLM Agent VerificationRuntime Enforcement for AI Agents

  12. Control the Harness, Control the Cost: Routing and Governing AI Coding Agents in the Enterprise

    Sep 24, 2026Arian Abbasi, Alan Aqrawi, Ted KwartlerTool-Augmented Language Model AgentsCoding Agents

  13. Driving Epidemic Models with AI Agents: the Epydemix Agent Framework

    Sep 23, 2026Nicolò Gozzi, Ciro Cattuto, Alessandro VespignaniAI Agents for Scientific DiscoveryLLM Agent Harnesses

  14. Harness as a Language: A Minimalist Agent Framework With Maximal Expressivity

    Sep 22, 2026Zhening Li, Joshua Liu, Mateja Vukelic +7LLM Agent MemoryLLM Agent Self-Improvement

  15. Harness-Zero: Harness Distillation via Agent-as-Harness

    Sep 21, 2026Haoran Ye, Yuxing Lu, Haonan Dong +2LLM Agent TrainingKnowledge Distillation

  16. Qwen-Audio-Agent Technical Report

    Sep 21, 2026Chong Deng, Yunjie Ji, Yuxiang Kong +5Multi-Agent OrchestrationLLM Agent Orchestration

  17. How Do Agent Harnesses Create Value? Planning Information and Release Control in Stateful LLM Agents

    Sep 17, 2026Yukun Zhang, Kemu Xu, Yishen ChenAgent Harness OptimizationLLM Agent Verification

  18. AeroWeaver: An Embodied-Agent Harness for Weaving Aerial Skills into Distributed, Adaptive Swarm Execution

    Sep 16, 2026Jiabin Lou, Yirong Yang, Haopeng Wang +6Aerial RoboticsSwarm Robotics

  19. TuiML: Machine Learning for AI Agents

    Sep 16, 2026Nilesh Verma, Nick Lim, Albert Bifet +1Tool-Using AgentsML Reproducibility

  20. Agentic Societies Need a Social Harness

    Sep 15, 2026Tapan Chugh, Vidushi Singh, Krish Jain +2AI Agent ReliabilityMulti-Agent System Security

  21. Ecdysis: Efficient and Effective Training of Runtime Harnesses for LLM Agents

    Sep 12, 2026Ruiqing Yue, Yu Cui, Zhuoyu Sun +11Agent Harness OptimizationLLM Agent Harnesses

  22. RobustSGPO: Search-Space Control for Agent Harness Evolution

    Sep 10, 2026Zibo Zhao, Jijun Shi, Mo Zhou +9Agentic WorkflowsAgent Harness Optimization

  23. What Does Multi-Harness RL Learn? Credit Assignment and Portability in Coding Agents

    Sep 7, 2026Chenqian Le, Jiayi Cheng, Qijia He +3RL for Code GenerationGroup Relative Policy Optimization