LLM Agent Harnesses

LLM: Large Language Model

Momentum

49 papers in the last four weeks, up 88% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 198

All topics
CardsList
  1. FinHarness: An Inline Lifecycle Safety Harness for Finance LLM Agents

    May 26, 2026Haoxuan Jia, Yang Liu, Bin Chong +10AI Agent ReliabilityLLM Guardrails

  2. Code as Agent Harness

    May 18, 2026Xuying Ning, Katherine Tieu, Dongqi Fu +39LLM Agent OrchestrationLong-Horizon LLM Agents

  3. Harnessing LLM Agents with Skill Programs

    May 18, 2026Hongjun Liu, Yifei Ming, Shafiq Joty +1LLM Agent Self-ImprovementLLM Agent Skill Learning

  4. Harnesses for Inference-Time Alignment over Execution Trajectories

    May 15, 2026Boyuan Wang, Bochao Li, Minghan Wang +2LLM PlanningAgent Harness Optimization

  5. Is Grep All You Need? How Agent Harnesses Reshape Agentic Search

    May 14, 2026Sahil Sen, Akhil Kasturi, Elias Lumer +2Agentic SearchLLM Agent Evaluation

  6. WildClawBench: A Benchmark for Real-World, Long-Horizon Agent Evaluation

    May 11, 2026Shuangrui Ding, Xuanlang Dai, Long Xing +14Computer-Use Agent BenchmarksTool-Augmented Language Model Agents

  7. Continual Harness: Online Adaptation for Self-Improving Foundation Agents

    May 11, 2026Seth Karten, Joel Zhang, Tersoo Upaa +5Continual Learning for LLM AgentsGame-Playing Agents

  8. Workspace Optimization: How to Train Your Agent

    May 10, 2026Elad Sarafian, Gal Kaplun, Ron Banner +2Multi-Agent LLM SystemsLLM Agent Self-Improvement

  9. Stop Comparing LLM Agents Without Disclosing the Harness

    May 7, 2026Yunbei Zhang, Janet Wang, Yingqiang Ge +3LLM Agent EvaluationLong-Horizon Agent Evaluation

  10. AgenticRAG: Agentic Retrieval for Enterprise Knowledge Bases

    May 7, 2026Susheel Suresh, Hazel Mak, Shangpo Chou +2Tool-Augmented Language Model AgentsAgentic Search

  11. Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses

    Apr 28, 2026Jiahang Lin, Shichun Liu, Chengjun Pan +8AI Coding AgentsAgent Harness Optimization

  12. The Last Harness You'll Ever Build

    Apr 22, 2026Haebin Seong, Li Yin, Haoran Zhang +1Meta-LearningAgent Harness Optimization

  13. EvoHarnessBench: Can Your Agents Keep Pace with an Evolving Harness?

    Date pendingZixuan Ke, Vaidehi Patil, Haizhou Shi +9Continual Learning for LLM AgentsLLM Agent Harnesses