Tool Use

Momentum

10 papers in the last four weeks, up 100% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 63

All topics
CardsList
  1. SchemaFill: Efficient LLM Tool Calling via Slot-Parallel Speculative Decoding

    Oct 5, 2026Zhi-Kai Chen, Song-Yan Li, De-Chuan Zhan +1Speculative DecodingLLM Inference Acceleration

  2. Turnslide: Scalable Multi-Turn Data Synthesis by Walking a Finite-State Machine

    Oct 5, 2026Aaron Fainman, Gabriela Kadlecová, Maciej Gryka +7LLM Fine-TuningSynthetic Data Generation

  3. ParaAgent: Reinforcing Parallel Acting in Open-World Tool Environments

    Sep 27, 2026Shengbin Yue, Hongru Wang, Siyuan Wang +3LLM Agent TrainingTool Use

  4. A Wrong Turn Does Not Ruin the Journey: Deviation-Guided Skill Self-Evolution for LLM Agents

    Sep 24, 2026Yichun Feng, Jiawei Wang, Haozhe SunLLM Agent Self-ImprovementLLM Agent Skill Learning

  5. Toolcompass: Guiding Tool Trialing, Not Suppressing It

    Sep 22, 2026Junlin Fang, Chong Zhang, Do Nguyen-Thanh +3Representation LearningTool-Augmented Language Model Agents

  6. MATCH: Model-Aware Tool Learning with Curriculum Scheduling and Hierarchically Gated Rewards

    Sep 17, 2026Shihao Liu, Hao Yin, Lijun Liu +3Reward ModelingCurriculum RL

  7. Ask the Tool, Don't Guess: Agent Tool Calls Hold Their Progress, and the Serving System Should Read It

    Sep 16, 2026Yipeng Liu, Yingqiang Zhang, Feifei Li +1LLM Inference EfficiencyKV Caching

  8. CoBRA: Learning Tool-Use Boundaries via Counterfactual Margins

    Sep 1, 2026Wenhao Zou, Xianglong Liu, Wendong Bi +3Tool UseRL for Tool Use

  9. One Policy Is Enough: Single-Agent Reinforcement Learning Outperforms Tree Search for Chemistry Tool Learning

    Aug 31, 2026Armin Dariani, Sifan Wu, Bang Liu +1LLM Tool UseTool Use

  10. SPIEval: Evaluating Large Language Models as Mobile Assistants over Scattered Personal Information

    Aug 11, 2026Junjie Ye, Zhuohui Sheng, Shaofan Liu +12LLM EvaluationAI Agent Benchmarks

  11. VTO: Visual Tool Orchestration for Video Anomaly Detection

    Aug 8, 2026Rui Wang, Yeteng Wu, Xianling Zhang +1Reinforcement LearningVideo Anomaly Detection

  12. Which Decisions Low-Bit Quantization Breaks, and How to Predict Them

    Aug 6, 2026Zekun Wu, Swati Dhiman, Adriano KoshiyamaPost-Training QuantizationLow-Bit Quantization

  13. A Master-Slave Robot Manipulator for Needle-Based Teleoperation in MRI Chamber

    Aug 6, 2026Omar Curiel, Jing-Yuan Huang, Po-Chih Chen +6Robot TeleoperationRobotics

  14. ToolLIFT: Lifting Tool-Specific Trajectories into Function-Level Graphs for Generalizable Tool Planning

    Aug 4, 2026Xiuhui You, Jiayi Luo, Zichao Shen +2Tool-Use PlanningTool Use

  15. Towards Robust Tool Use in Agents via Experience-Driven Adaptive Guidance

    Aug 4, 2026Can Wang, Haoran Chen, Li Yu +4Tool-Using AgentsLLM Tool Use

  16. Screenshots or Tools? Eliciting Tool Use and Managing Multimodal Context in Hybrid GUI-MCP Computer-Use Agents

    Aug 4, 2026Siqi Fan, Minghao Li, Xiaoqian Ma +6Computer-Use AgentsRL for LLM Agents

  17. ScrambleToolBench: Agents Search Exhaustively Even When Their Own Map Points to the Next Step

    Aug 3, 2026Vernon Toh, Navonil Majumder, Zhengyuan Liu +2LLM Agent EvaluationAI Agent Benchmarks

  18. Verified Tool Calls Improve LLM Agent Reliability Under Non-Atomic Failures

    Jul 31, 2026Isham Kalappurackal Mansoor, Abhishek Phadke, Pratip RanaAI Agent ReliabilityLLM Tool Use

  19. E-Bench: Benchmarking Multi-Step Tool-Use Agents in Real-World Product Scenarios

    Jul 26, 2026Weihuang Zheng, Tianyuan Zou, Eileen Ye +5Computer-Use Agent BenchmarksTool-Use Evaluation

  20. FuncBridge: Towards Functional Tool-Use Generalization via Keypoint Trajectory Reasoning

    Jul 7, 2026Chuhao Zhou, Liquan Wang, Shuxin Cao +5Robot Skill LearningGeneralization in Robotic Manipulation