LLM Agent Harnesses

LLM: Large Language Model

Momentum

49 papers in the last four weeks, up 88% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 198

All topics
CardsList
  1. MechMath Agent Team: LLM Driven Agents for Mathematical Research

    Jul 5, 2026Yichuan Cao, Ruichen Qiu, Junqi Liu +5Automated Theorem ProvingMulti-Agent Reasoning

  2. Harness-Aware Self-Evolving: Co-Evolving Model Weights, Harness, and Task Solutions

    Jul 4, 2026Haochen Luo, Yi Huang, Sichun Luo +5Agentic RLAgent Harness Optimization

  3. LLMoxie: Exploring Agentic AI for Scientific Software Development

    Jul 2, 2026Landung Setiawan, Anant Mittal, Cordero Core +5Scientific Code GenerationAI Agent Governance

  4. COMFYCLAW: Self-Evolving Skill Harnesses for Image Generation Workflows

    Jul 2, 2026Zongxia Li, Dawei Liu, Fuxiao Liu +6Image GenerationAgentic Image Generation

  5. Evaluating Agentic Harness Systems for Autonomous Computational Pathology

    Jul 1, 2026Jie Lin, Zongyi Chen, Qiaoling Zheng +6Computational PathologyLLM Agent Evaluation

  6. SWE-Router: Routing in Multi-turn Agentic Software Engineering Tasks

    Jun 30, 2026Seongho Son, Sangwoong Yoon, Jiahua Tang +3Software Engineering AgentsLLM Agent Workflow Optimization

  7. Agentic Hardware Design as Repository-Level Code Evolution

    Jun 26, 2026Cunxi Yu, Chenhui Deng, Nathaniel Pinckney +1Software EngineeringElectronic Design Automation

  8. The Interplay of Harness Design and Post-Training in LLM Agents

    Jun 24, 2026Kyungmin Kim, Youngbin Choi, Seoyeon Lee +3Agent Harness OptimizationLLM Agents

  9. Harness-MU: A Safe, Governed, and Effective Harness for Multi-User LLM Agents

    Jun 20, 2026Wangxuan Fan, Xiaoyu Nie, Zhongxiang DaiPrivacy-Preserving Language ModelsLLM Agent Security

  10. AgentMeter: Evaluating Model-CLI Matching for CLI-Based Local Task-Solving Agents

    Jun 19, 2026Han Chi, Jiaxin Qi, Yan Cui +2LLM Agent EvaluationAI Agent Benchmarks

  11. Building Agent Harnesses for Scientific Curation from Multimodal Sources

    Jun 19, 2026Sheng Zhang, Qin Liu, Renqian Luo +9Document Information ExtractionScientific Workflow Automation

  12. Dissecting model behavior through agent trajectories

    Jun 16, 2026Gaurav Gupta, Vatshank Chaturvedi, Jun Huan +1Software Engineering AgentsLLM Agent Evaluation

  13. RHO: Your Coding Agent is Secretly a Roboticist

    Jun 15, 2026Karim Elmaaroufi, Justin Svegliato, Sarunas Kalade +3Robot Policy LearningAI Coding Agents

  14. From Question Answering to Task Completion: A Survey on Agent System and Harness Design

    Jun 14, 2026Jianyuan Guo, Zhiwei Hao, Chengcheng Wang +14LLM Agent EvaluationLLM Agents

  15. Recursive Agent Harnesses

    Jun 11, 2026Elias Lumer, Sahil Sen, Kevin Paul +1Tool-Augmented Language Model AgentsLLM Agent Orchestration

  16. HarnessBridge: Learnable Bidirectional Controller for LLM Agent Harness

    Jun 11, 2026Xiaoxuan Wang, Haixin Wang, Alexander Taylor +3Agent Harness OptimizationLLM Agent Training

  17. Self-Harness: Harnesses That Improve Themselves

    Jun 8, 2026Hangfan Zhang, Shao Zhang, Kangcong Li +5Agent Harness OptimizationLLM Agent Self-Improvement

  18. Bayesian-Agent: Posterior-Guided Skill Evolution for LLM Agent Harnesses

    Jun 6, 2026Xiaojun Wu, Cehao Yang, Honghao Liu +7Agent Harness OptimizationLLM Agent Workflow Optimization

  19. From Failed Trajectories to Reliable LLM Agents: Diagnosing and Repairing Harness Flaws

    Jun 4, 2026Mengzhuo Chen, Junjie Wang, Zhe Liu +3Agent Failure AnalysisSelf-Improving Agents

  20. Exploring Cross-Scenario Generality of Agentic Memory Systems: Diagnostics and a Strong Baseline

    Jun 3, 2026Zhikai Chen, Jialiang Gu, Junyu Yin +6Agent MemoryLLM Agent Memory

  21. MUSE: A Unified Agentic Harness for MLLMs

    Jun 2, 2026Jianglin Lu, Hailing Wang, Xu Ma +4Multimodal ReasoningMultimodal Agents

  22. HarnessForge: Joint Harness and Policy Evolution for Adaptive Agent Systems

    Jun 1, 2026Mingju Chen, Can Lv, Guibin Zhang +2Agent Harness OptimizationLLM Agent Self-Improvement

  23. Adaptive Auto-Harness: Sustained Self-Improvement for Agentic System Deployment on Open-Ended Task Streams

    Jun 1, 2026Zewen Liu, Zhan Shi, Yisi Sang +7Continual Learning for LLM AgentsAgent Harness Optimization

  24. Harness Updating Is Not Harness Benefit: Disentangling Evolution Capabilities in Self-Evolving LLM Agents

    May 28, 2026Minhua Lin, Juncheng Wu, Zijun Wang +14LLM Agent EvaluationAgent Harness Optimization