RL for Tool Use

RL: Reinforcement Learning

Momentum

17 papers in the last four weeks, up 42% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 127

All topics
CardsList
  1. SCRIBE: Structured Mid-Level Supervision for Tool-Using Language Models

    Jan 7, 2026Yuxuan Jiang, Francis FerraroProcess Reward ModelsRL for Language Model Reasoning

  2. Experience-Evolving Multi-Turn Tool-Use Agent with Hybrid Episodic-Procedural Memory

    Dec 8, 2025Sijia Li, Yuchen Huang, Zifan Liu +6RL ExplorationGraph-Based Agent Memory

  3. Proof-of-Use: Mitigating Tool-Call Hacking in Deep Research Agents

    Oct 13, 2025Shengjie Ma, Chenlong Deng, Jiaxin Mao +5LLM Agent ReliabilityRL for Tool Use

  4. DeepTravel: An End-to-End Agentic Reinforcement Learning Framework for Autonomous Travel Planning Agents

    Sep 26, 2025Yansong Ning, Rui Liu, Jun Wang +6Agentic RLLLM Agent Training

  5. TRUST-SQL: Tool-Integrated Multi-Turn Reinforcement Learning for Text-to-SQL over Unknown Schemas

    Date pendingAi Jian, Xiaoyun Zhang, Eryu Guo +6Schema LinkingGroup Relative Policy Optimization

  6. PCBWorld: A Benchmark Environment for Engine-Grounded PCB Design Automation

    Date pendingHyungseok Song, Junseok Park, Won-Seok Choi +4Electronic Design AutomationAI Agent Benchmarks