LLM Tool Use

LLM: Large Language Model

Momentum

30 papers in the last four weeks, up 233% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 185

All topics
CardsList
  1. A Tool-Augmented, GPT-4 Chatbot for Real-Time Repository Data Analysis

    Sep 7, 2026Muhammad Jawad Chowdhury, Md. Sakib KhanSoftware EngineeringLLM Prompting

  2. CivBench: A Long-Horizon Benchmark for Tool-Mediated Agents in Civilization VI

    Sep 2, 2026Austin Tudor David Andrews, Liam Wilkinson, Jamie Heagerty +3LLM Agent EvaluationLLM Tool Use

  3. Harness Engineering in LLM Tool Use via Agent-Native Reusable Tool Primitives

    Sep 1, 2026Haibo Jin, Suijin Wang, Xucheng Yu +2Tool-Augmented Language Model AgentsLLM Agent Orchestration

  4. Calibration is the Bottleneck: An Action-Class Diagnostic of Multi-Turn Tool-Calling

    Sep 1, 2026Kangjia Zhao, Jiajun Li, Haozhan Shen +8Tool-Use EvaluationLLM Agent Evaluation

  5. One Policy Is Enough: Single-Agent Reinforcement Learning Outperforms Tree Search for Chemistry Tool Learning

    Aug 31, 2026Armin Dariani, Sifan Wu, Bang Liu +1LLM Tool UseTool Use

  6. TUE-Detector: A Tool-Using Expert MLLM-Based Detector for AI-Generated Videos

    Aug 31, 2026Yichen Wu, Haoxuan Qu, Yongxing Dai +5Multimodal Large Language ModelsDeepfake Detection

  7. Learning to Reason and Use Tools through Unsupervised Fine-Tuning in Task-Oriented Dialog Systems

    Aug 31, 2026Markel Ferro, Oier Lopez de LacalleSelf-Training for Language ModelsLLM Fine-Tuning

  8. VAKRA: Evaluating Multi-Hop Reasoning Across APIs and Retrieval Under Tool-Use Policies

    Aug 12, 2026Ankita Rajaram Naik, Anupama Murthi, Benjamin Elder +6Tool-Use EvaluationAI Agent Benchmarks

  9. DOCSCHISEL: Adaptive Tool Documentation Optimization Framework for LLM Agents

    Aug 10, 2026You Lu, Kun Zhang, Bihuan Chen +1Tool-Augmented Language Model AgentsTool-Using Agents

  10. LLM within MCP Matters: Measuring Inefficient Resource Utilization Driven by LLMs

    Aug 9, 2026Minhan Cho, Soyoung Park, Kihyeon Jeong +3LLM Inference EfficiencyInstruction Following

  11. The Bitter Lesson of Tool Calling

    Aug 6, 2026Ishan Patel, Sahil Sen, Elias Lumer +1LLM EvaluationTool-Augmented Language Model Agents

  12. When History Lies: Evaluating and Improving Tool Use under Misleading Multi-Turn Histories

    Aug 6, 2026Xiaoqing Wu, Xingyu Fan, Feifei Li +1Tool-Use EvaluationLLM Tool Use

  13. Towards Robust Tool Use in Agents via Experience-Driven Adaptive Guidance

    Aug 4, 2026Can Wang, Haoran Chen, Li Yu +4Tool-Using AgentsLLM Tool Use

  14. PredAct-Bench: Benchmarking Tool-Augmented Dialogue under Controlled Tool Noise

    Aug 3, 2026Abdulrahman AlRabah, Xiaocheng Yang, Dilek Hakkani-Tür +1AI Agent ReliabilityAI-Assisted Decision Making

  15. OoO-Spec: Out-of-Order Semantic Speculation for Fast Tool Calling

    Aug 1, 2026Zhiheng Zhang, Mujie Xu, Feiyu Sun +1Speculative DecodingLLM Inference Acceleration

  16. HyperAgent: Planning and Acting over Tool-Schema Hypergraphs for Tool-Use LLM Agents

    Jul 31, 2026Zian Zhai, Xingyu Tan, Gaowang Zou +2LLM Tool UseGraph-Based Planning

  17. Verified Tool Calls Improve LLM Agent Reliability Under Non-Atomic Failures

    Jul 31, 2026Isham Kalappurackal Mansoor, Abhishek Phadke, Pratip RanaAI Agent ReliabilityLLM Tool Use

  18. Flat Score, Amplified Failures: How the Error Budget Masks Damage in Quantized LLM Agents

    Jul 29, 2026Jiwon Jang, Kisu Yang, Heuiseok Lim +1AI Agent ReliabilityBenchmark Design

  19. Tools Are Not Islands: Set-Level Tool Retrieval for LLM Agents via Query-Conditioned Hyperedge Prediction

    Jul 28, 2026Xinyi Hong, Pinjun Dong, Xinyang Yu +1Tool-Augmented Language Model AgentsLLM Tool Use