LLM-Guided RL

RL: Reinforcement Learning

Momentum

8 papers in the last four weeks, up 60% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 76

All topics
CardsList
  1. RHyVE: Competence-Aware Verification and Phase-Aware Deployment for LLM-Generated Reward Hypotheses

    Apr 30, 2026Feiyu Wu, Xu Zheng, Zhuocheng Wang +2Reinforcement LearningLLM-Guided RL

  2. Bridging Reasoning and Action: Hybrid LLM-RL Framework for Efficient Cross-Domain Task-Oriented Dialogue

    Apr 25, 2026Yangyang Zhao, Linfan Dai, Li Cai +2Constrained RLLLM-Guided RL

  3. Scaling Self-Play with Self-Guidance

    Apr 22, 2026Luke Bailey, Kaiyue Wen, Kefan Dong +2Self-Play RLAutomated Theorem Proving

  4. Do LLM-derived graph priors improve multi-agent coordination?

    Apr 19, 2026Nikunj Gupta, Rajgopal Kannan, Viktor PrasannaMulti-Agent CoordinationLLM-Guided RL

  5. GRAIL: Autonomous Concept Grounding for Neuro-Symbolic Reinforcement Learning

    Apr 18, 2026Hikaru Shindo, Henri Rößler, Quentin Delfosse +1Reinforcement LearningLLM-Guided RL

  6. Generalizable Dense Reward for Long-Horizon Robotic Tasks

    Mar 31, 2026Silong Yong, Stephen Sheng, Carl Qi +6Reinforcement LearningLong-Horizon Robotic Manipulation

  7. DriveVLM-RL: Neuroscience-Inspired Reinforcement Learning with Vision-Language Models for Safe and Deployable Autonomous Driving

    Mar 18, 2026Zilin Huang, Zihao Sheng, Zhengyang Wan +4VLMs for Autonomous DrivingLLM-Guided RL

  8. LLM-Guided Reinforcement Learning for Audio-Visual Speech Enhancement

    Mar 14, 2026Chih-Ning Chen, Jen-Cheng Hou, Hsin-Min Wang +3LLM-Guided RLSpeech Enhancement

  9. Novelty Adaptation Through Hybrid Large Language Model (LLM)-Symbolic Planning and LLM-guided Reinforcement Learning

    Mar 11, 2026Hong Lu, Pierrick Lorang, Timothy R. Duggan +2Symbolic PlanningLLM-Guided RL

  10. PhGPO: Pheromone-Guided Policy Optimization for Long-Horizon Tool Planning

    Feb 14, 2026Yu Li, Guangfeng Cai, Shengtian Yang +5LLM-Guided RLTool-Use Planning

  11. Don't Tell the Answer, Truly Guide the Reasoning During RL Rollouts

    Oct 10, 2025Xinyi Wang, Jinyi Han, Zishang Jiang +7Reinforcement LearningRL for Language Model Reasoning

  12. CLARity: Reasoning Consistency Alone Can Teach Reinforced Experts

    Oct 10, 2025Jiuheng Lin, Cong Jiang, Zirui Wu +2RL for Language ModelsRL for Language Model Reasoning

  13. Selective Expert Guidance for Effective and Diverse Exploration in Reinforcement Learning of LLMs

    Oct 5, 2025Zishang Jiang, Jinyi Han, Tingyun Li +7RL for Language Model ReasoningLLM-Guided RL

  14. Self-CriTeach: LLM Self-Teaching and Self-Critiquing for Improving Robotic Planning via Automated Domain Generation

    Sep 25, 2025Jinbang Huang, Zhiyuan Li, Yuanzhao Hu +4Large Language Model-Based Robot PlanningSynthetic Data Generation for Robotics

  15. Agentic Episodic Control

    Jun 2, 2025Xidong Yang, Wenhao Li, Junjie Sheng +4Agentic RLReinforcement Learning