LLM-Guided RL

RL: Reinforcement Learning

Momentum

8 papers in the last four weeks, up 60% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 76

All topics
CardsList
  1. Ask the Expert: LLM-Guided Reinforcement Learning for Autonomous Cyber Defense

    Oct 7, 2026Fernando Martinez, Abhishek Satyam, Tao Li +3Autonomous Cyber DefenseLLM-Guided RL

  2. An LLM-in-the-loop RL Framework for Bioinformatics Feature Selection

    Oct 4, 2026Xinyuan Wang, Deepti Agrawal, Yanjie FuReinforcement LearningLLM-Guided RL

  3. Iterative Policy Refinement through Semantic Rollout Analysis

    Oct 1, 2026Feiyu Gavin Zhu, Qi Xu, Zhifei Deng +4Policy OptimizationLLM-Guided RL

  4. Guide, Then Let Go: Gap-Adaptive Teacher Scheduling for Sparse-Reward Agentic RL

    Sep 29, 2026Youling Huang, Tiankuo Xu, Jiaji Liu +10Agentic RLLLM-Guided RL

  5. Agentic AI Networking for Heterogeneous Unmanned Aerial Systems in Low-Altitude Wireless Networks

    Sep 17, 2026Nguyen Duc Minh Quang, Chang Liu, Shuangyang Li +1LLM-Guided RLWireless Communications

  6. Specifying Reward Functions for RL Without Environment Sampling

    Sep 14, 2026Stephane Hatgis-Kessell, W. Bradley Knox, Emma BrunskillLLM-Guided RLReward Design for RL

  7. Smart Adaptive Computing Across the Continuum: LLMs in IoT-Edge-Cloud Resource Management

    Sep 10, 2026Antonino Vaccarella, Lanpei Li, Vincenzo Lomonaco +1Language Model-Based ControlLLM-Guided RL

  8. Reinforcement Learning Enhanced LLM Agents for Complex Vehicle Routing Problems

    Sep 1, 2026Yi Chen, Zikang Yu, Jiahai Wang +3Multi-Agent System OptimizationLLM-Guided RL

  9. From Solver Feedback to Faithful Plans: Multi-Role Reinforcement Learning for Symbolic Planning

    Aug 22, 2026Chenghao Zhang, Yikai Mao, Haoyu Gao +4LLM PlanningSymbolic Planning

  10. LoongReflect: Boosting Long-Horizon Reflection in Search Agents via Global Perspective Distillation

    Aug 12, 2026Zhixin Zhang, Xinke Jiang, Zhibang Yang +5LLM-Guided RLLLM Agents

  11. Mitigating Bus Bunching with Reinforcement Learning Enhanced by Semantic Stop Embedding

    Aug 10, 2026Xin Dong, Vikash V. GayahRL ControlLLM-Guided RL

  12. ProDVI: Programmatic Dynamics Priors for Value Network Initialization

    Aug 6, 2026Xinwei Liu, Junyuan Liang, Jianting Zhang +1Reinforcement LearningLLM-Guided RL

  13. Hybrid LLM-Augmented Reinforcement Learning Agents for Complex Sequential Decision Tasks

    Aug 4, 2026Christophe D. Hounwanou, John Emeka Eze, Yaé Ulrich GabaLLM-Guided RLLong-Horizon LLM Agents

  14. PROGRESS: Coverage-guided RL to Train Search-augmented LLM Agent

    Aug 2, 2026Sudipta Paul, Vijay Srinivasan, Vivek Kulkarni +4Reward ShapingLLM-Guided RL

  15. Distilling Knowledge from Large Language Models into Lightweight Reinforcement Learning Agents for Autonomous Cyber Operations

    Jul 30, 2026Konur Tholl, François Rivest, Mariam El Mezouar +2Autonomous Cyber DefenseLLM-Guided RL

  16. LEACL: LLM-Enhanced Automatic Curriculum Learning for Reinforcement Learning in Long-Horizon Manipulation Tasks

    Jul 26, 2026Faraz Heravi, James Ouyang, Zifan Xu +3LLM-Guided RLRobotic Manipulation

  17. Prompt-Driven Exploration

    Jul 9, 2026Sunshine Jiang, John Marangola, David Zhang +6LLM-Guided RLRL Exploration

  18. Open-ended Multi-agent Autocurricula via Visual Inspection of Policies with Multi-modal LLMs

    Jul 9, 2026Lorenzo Pantè, Andrea Fanti, Roberto CapobiancoGame-Playing AgentsCurriculum RL

  19. TREK: Distill to Explore, Reinforce to Refine

    Jul 6, 2026Yuanda Xu, Zhengze Zhou, Kayhan Behdin +10RL for Language Model ReasoningLLM-Guided RL

  20. Regime-Conditional Stabilisation of LLM-Augmented Cooperative Multi-Agent Reinforcement Learning

    Jul 5, 2026Faid Keddouri, Sohaib Houhou, Aissa Boulmerka +1Reward ShapingLLM-Guided RL

  21. ASK in the Dark: Uncertainty-Gated LLM Assistance under Partial Observability

    Jul 2, 2026Juarez Monteiro, Nathan Gavenski, Guilherme Lima +3Partially Observable RLLLM Prompting

  22. Safe and Adaptive Cloud Healing: Verifying LLM-Generated Recovery Plans with a Neural-Symbolic World Model

    Jul 2, 2026Junyan Tan, Haoran Lin, Siyuan Guo +4LLM-Based Program SynthesisLLM-Guided RL

  23. Calibrating the Evaluator: Does Probability Calibration Mitigate Preference Coupling in LLM Agent Feedback Loops?

    Jun 30, 2026Zewen LiuLLM-as-a-JudgePairwise Preference Evaluation

  24. LaGO: Latent Action Guidance for Online Reinforcement Learning

    Jun 23, 2026Kuan-Yen Liu, Ren-Jyun Huang, Ti-Rong WuLatent Action LearningLLM-Guided RL

  25. Causal Reward World Models: Zero-shot Reward Design for Automated Skill Generation

    Jun 22, 2026Yang Yang, Yuchuang Tong, Zhengtao Zhang +6RL for RoboticsRobot Skill Learning

  26. Curriculum Reinforcement Learning Can Incentivize Reasoning Capacity in LLMs Beyond the Base Model

    Jun 21, 2026Pengxiang Cai, Tianchen Fang, Xiaohan Li +3RL for Language Model ReasoningCurriculum RL

  27. Hierarchical Control in Multi-Agent Games: LLM-based Planning and RL Execution

    Jun 18, 2026Jannik Hösch, Alessandro Sestini, Florian Fuchs +6Sequential MARLMulti-Agent Coordination