Multi-Task RL

RL: Reinforcement Learning

Latest papers 55

All topics
CardsList
  1. Representation Learning Enables Scalable Multitask Deep Reinforcement Learning

    Jun 4, 2026Johan Obando-Ceron, Lu Li, Scott Fujimoto +3Reinforcement LearningRepresentation Learning for RL

  2. Generalizable Multi-Task Learning for Wireless Networks Using Prompt Decision Transformers

    Jun 3, 2026Fatih Temiz, Shavbo Salehi, Melike Erol-KantarciReinforcement LearningTransformer

  3. A GPU-Parallel Framework for Heterogeneous Multi-Task Reinforcement Learning

    Jun 2, 2026Rui Zhang, Qiwei Wu, Zhengyu Zhang +7Robotic RLLearning from Demonstration

  4. A Local Perturbation Theory for Cross-Domain Interference and Recovery in Multi-Domain RL

    Jun 1, 2026Lei Yang, Siyu Ding, Deyi XiongRL for Language ModelsReinforcement Learning

  5. CARE-RL: Capability-Aware Reinforcement Learning for Mitigating Cross-Domain Conflicts

    May 30, 2026Rui Zhang, Xinle Wu, Yao LuReward ModelingReinforcement Learning

  6. Reasoning Depth and Environment Complexity: A Controlled Study of RLVR Data Allocation across Logical Reasoning Tasks

    May 26, 2026Yihua Zhu, Qianying Liu, Fei Cheng +4Logical ReasoningAbductive Reasoning

  7. Adaptive Reinforcement Learning for Robust Open Quantum System Control: A Multi-Task Framework with Temporal Optimization

    May 26, 2026Haftu W. Fentaw, Steve Campbell, Simon CatonRL ControlMulti-Task RL

  8. Harmony in Diversity: Multi-domain Contrastive Policy Optimization for Large Reasoning Models

    May 25, 2026Zongji Yu, Wenshui Luo, Yiliu Sun +5Reinforcement LearningRL for Language Model Reasoning

  9. GoLongRL: Capability-Oriented Long Context Reinforcement Learning with Multitask Alignment

    May 19, 2026Minxuan Lv, Tiehua Mei, Tanlong Du +9Reinforcement LearningLong-Context Modeling

  10. DyGRO-VLA: Cross-Task Scaling of Vision-Language-Action Models via Dynamic Grouped Residual Optimization

    May 17, 2026Sixu Lin, Yunpeng Qing, Litao Liu +4Vision-Language-Action ModelsMulti-Task RL

  11. Distributionally Robust Multi-Task Reinforcement Learning via Adaptive Task Sampling

    May 14, 2026Nicholas E. Corrado, Wenyuan Huang, Josiah P. HannaDistributionally Robust RLMulti-Task RL

  12. TOPPO: Rethinking PPO for Multi-Task Reinforcement Learning with Critic Balancing

    May 12, 2026Yuanpeng Li, Gefei Lin, Annie Qu +1Multi-Task RLProximal Policy Optimization

  13. MARLaaS: Multi-Tenant Asynchronous Reinforcement Learning as a Service

    May 8, 2026Timothy Tin Long Yu, Gursimran Singh, Ge Shi +3Asynchronous RLReinforcement Learning

  14. Schedule-and-Calibrate: Utility-Guided Multi-Task Reinforcement Learning for Code LLMs

    May 7, 2026Yujia Chen, Yang Ye, Xiao Chu +2RL for Code GenerationReinforcement Learning

  15. Improving Zero-Shot Offline RL via Behavioral Task Sampling

    Apr 28, 2026Nazim Bendib, Nicolas Perrin-Gilbert, Olivier SigaudReinforcement LearningOffline RL

  16. Multi-action Tangled Program Graphs for Multi-task Reinforcement Learning with Continuous Control

    Apr 28, 2026Quentin Vacher, Nicolas Beuve, Mickaël Dardaillon +1RL BenchmarksGenetic Programming

  17. Task-specific Subnetwork Discovery in Reinforcement Learning for Autonomous Underwater Navigation

    Apr 23, 2026Yi-Ling Liu, Melvin Laux, Mariela De Lucas Alvarez +2Reinforcement LearningUnderwater Robotics

  18. RPG: Robust Policy Gating for Smooth Multi-Skill Transitions in Humanoid Fighting

    Apr 23, 2026Yucheng Xin, Jiacheng Bao, Yubo Dong +5Robot Policy LearningHumanoid Robot Control

  19. Reinforcement Learning Enabled Adaptive Multi-Task Control for Bipedal Soccer Robots

    Apr 21, 2026Yulai Zhang, Yinrong Zhang, Ting Wu +1Legged RoboticsHumanoid Robot Control

  20. To Mix or To Merge: Toward Multi-Domain Reinforcement Learning for Large Language Models

    Feb 13, 2026Haoqing Wang, Xiang Long, Ziheng Li +3RL for Language ModelsGradient Interference

  21. PlatoLTL: Scaling LTL-Guided Multi-Task RL

    Jan 30, 2026Jacques Cloete, Mathias Jackermeier, Ioannis Havoutis +1RL for RoboticsConstrained RL

  22. DiffusionOPD: A Unified Perspective of On-Policy Distillation in Diffusion Models

    Date pendingQuanhao Li, Junqiu Yu, Kaixun Jiang +7Diffusion Model DistillationMulti-Task RL

  23. SkillX: Unified Multi-Skill Policy Learning for Humanoid Soccer

    Date pendingZhangchen Ye, Enxuan Ruan, Yifei Bao +10Robot Skill LearningHumanoid Robot Control