Offline RL

RL: Reinforcement Learning

Momentum

29 papers in the last four weeks, up 222% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 189

All topics
CardsList
  1. Adaptive Agent Design

    Sep 14, 2026Raj Kiriti Velicheti, Subhonmesh Bose, Tamer BaşarReinforcement LearningQ-Learning

  2. SCQ: Stabilizing Conservative Q-Learning with Sigmoid-Bounded Entropy

    Sep 14, 2026Xiefeng Wu, Shu Zhang, Zhaojie Chu +1Robotic RLOffline RL

  3. Offline Reinforcement Learning for Wind Farm Control: A Wind Tunnel Study under Dynamic Wind Directions

    Sep 14, 2026Yuhan Su, Hongyang Dong, Simone Tamaro +3RL ControlReinforcement Learning

  4. Direct Diversity Optimization for Diverse Successful Trajectories in Preference Post-Training

    Sep 9, 2026Junwon Ko, Dong-Jae Lee, Minchan Kwon +2Offline RLPreference Optimization

  5. Routing Dense Layouts with History-Aware Offline Reinforcement Learning using LSTM

    Sep 8, 2026Afsara Khan, Austin RovinskiReinforcement LearningOffline RL

  6. Multi-step Proximal Policy Improvement in Offline Reinforcement Learning

    Sep 3, 2026Soohyun Choi, Seonvin Cho, Songnam HongOffline RLPolicy Learning

  7. Recursive Value Learning for Long-Horizon Offline Goal-Conditioned RL

    Sep 2, 2026Hyeonseong Jeon, Youngwoon LeeReinforcement LearningOffline RL

  8. WiSDoM: Wireless Sparse Decision Transformer with Mixture-of-Experts for Multi-Task Mobile Network Optimization

    Aug 31, 2026Fatih Temiz, Shavbo Salehi, Melike Erol-KantarciSparse Mixture-of-ExpertsDecision Transformer

  9. Three Steps at a Time: Learning Representations from Action Sequences in Contrastive RL

    Aug 31, 2026Michal Korniak, Kamil Dybek, Benjamin Eysenbach +2Reinforcement LearningOffline RL

  10. Redistribution-based Cost Inference Improves Sparse Safe Offline RL

    Aug 12, 2026Ebenezer Gelo, Geraud Nangue Tasse, Steven James +1Credit Assignment in RLStep-Level Credit Assignment in RL

  11. Unmasking Toxic Mimicry in Medical Offline Reinforcement Learning for ICU Sepsis Management via Counterfactual Clinical Audits

    Aug 11, 2026Hangqi Ren, Junyi LiaoCounterfactual EvaluationOffline RL

  12. Dynamics Models for Offline Hyperparameter Selection in Real-World RL

    Aug 11, 2026Jordan Coblin, Han Wang, Martha White +1RL ControlOffline RL

  13. CODS: Iterative Bellman-Residual Data Selection for Reusable Offline Reinforcement Learning

    Aug 7, 2026Ibne Farabi Shihab, Sanjeda Akter, Abu Sa-Adat Mohamed Moon-Im Al Ahsan +2Offline RL

  14. Learning Clinical-Trial Strategy: Offline Policy Training for Decision Agents

    Aug 4, 2026William Bolton, Philip TorrClinical Decision-MakingImitation Learning

  15. Convex-Hull-Neighborhood Smooth Dual Generalization: Controlling Local Correction Propagation in Offline RL

    Aug 4, 2026Yi Yang, Zhennan Chen, Mingfeng Lv +3OOD GeneralizationOffline RL

  16. Diffusion Policy with Behavioral Advantage Correction for Offline Reinforcement Learning

    Aug 3, 2026Botao Dong, Longyang Huang, Ning Pang +1Distribution ShiftValue Function Estimation

  17. ReBRAC-v2: The Return of the King

    Aug 2, 2026Denis Tarasov, Robert K. KatzschmannReinforcement LearningOffline RL

  18. RMSWeb: Reflection, Failure-Mode Mining, and Salvage-DS for Web Agent Reinforcement Learning

    Jul 31, 2026Chengbo Liu, Lifang Zhou, Ruijie Yan +8Reward ShapingOffline RL

  19. RedFlow: Redirect Failure into Action-level Corrections for Flow-matching VLA Policy

    Jul 30, 2026Zhengyang Yan, Junhao Li, Fangqi Zhu +6Robot Policy LearningPolicy Optimization

  20. Learning from the Unseen: Offline Reinforcement Learning with Hidden Actions

    Jul 28, 2026Zeyu Bian, Ying Zhou, Yifan CuiCausal Effect EstimationOff-Policy Evaluation

  21. Label-free Industrial Fault Detection via Adversarial Inverse Reinforcement Learning: A System for Run-to-Failure Prognostics

    Jul 25, 2026Dhiraj Neupane, Mohamed Reda Bouadjenek, Richard Dazeley +1Reinforcement LearningIndustrial Anomaly Detection

  22. TOUR: A Trajectory-Level Unlearning Benchmark for Offline Reinforcement Learning

    Jul 23, 2026Chaofan Pan, Lingfei Ren, Xiangyu Jiang +6RL BenchmarksMembership Inference Attacks

  23. Offline RL with Hierarchical Action Chunking

    Jul 23, 2026Ahad JawaidHierarchical RLOffline RL

  24. Conservative Query and Adaptive Regularization for Offline RL Under Uncertainty Estimation

    Jul 21, 2026Li-Rong Zhou, Qin-Wen Luo, Sheng-Jun HuangReinforcement LearningOffline RL

  25. REGEN: Replay-recycling for Expert-to-Generalist distillation with Offline Reinforcement Learning

    Jul 21, 2026Yunjie Chen, Xiaoxin Chen, Fang WangRL for Language ModelsRL for Language Model Reasoning