RL Benchmarks

RL: Reinforcement Learning

Momentum

10 papers in the last four weeks, up 233% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 62

All topics
CardsList
  1. Physical Atari: A Robust and Accessible Platform for Real-time Reinforcement Learning on Robots

    May 29, 2026Khurram Javed, Joseph Modayil, Gloria Kennickell +2RL BenchmarksReinforcement Learning

  2. When Does Deep RL Beat Calibrated Baselines? A Benchmark Study on Adaptive Resource Control

    May 26, 2026Guilin Zhang, Chuanyi Sun, Kai Zhao +3RL ControlRL Benchmarks

  3. Benchmarking the Limits of In-Context Reinforcement Learning for Ad-Hoc Teamwork

    May 23, 2026Yuheng Jing, Kai Li, Ziwen Zhang +8RL BenchmarksMulti-Agent Coordination

  4. Mahjax: A GPU-Accelerated Mahjong Simulator for Reinforcement Learning in JAX

    May 20, 2026Soichiro Nishimori, Shinri Okano, Keigo Habara +3RL BenchmarksGame-Playing Agents

  5. JAXenstein: Accelerated Benchmarking for First-Person Environments

    May 19, 2026Ruo Yu Tao, George KonidarisRL BenchmarksPartially Observable RL

  6. Offline Reinforcement Learning for Plasma Control in Nuclear Fusion: Codebase and Benchmark

    May 19, 2026Yang Fu, Haomin Bao, Rohit Sonker +4RL BenchmarksOffline RL

  7. ARC-RL: A Reinforcement Learning Playground Inspired by ARC Raiders

    May 19, 2026Carlo Romeo, Andrew D. BagdanovRL BenchmarksRobotics Simulation

  8. Data-Augmented Game Starts for Accelerating Self-Play Exploration in Imperfect Information Games

    May 14, 2026JB Lanier, Nathan Monette, Pierre Baldi +1RL BenchmarksSelf-Play RL

  9. Towards Affordable Energy: A Gymnasium Environment for Electric Utility Demand-Response Programs

    May 12, 2026Jose E. Aguilar Escamilla, Lingdong Zhou, Xiangqi Zhu +1RL BenchmarksReinforcement Learning

  10. gym-invmgmt: An Open Benchmarking Framework for Inventory Management Methods

    May 12, 2026Reza Barati, Qinmin Vivian HuInventory ControlRL Benchmarks

  11. Higher Resolution, Better Generalization: Unlocking Visual Scaling in Deep Reinforcement Learning

    May 11, 2026Raphael Trumpp, Ömer Veysel Çağatan, Barış Akgün +1RL BenchmarksRobot Policy Generalization

  12. When (and How) to Trust the Expert: Diagnosing Query-Time Expert-Guided Reinforcement Learning

    May 9, 2026Yann Berthelot, Philippe Preux, Riad AkrourRL ControlRL Benchmarks

  13. Forge: Quality-Aware Reinforcement Learning for NP-Hard Optimization in LLMs

    May 9, 2026Xiaozhe Li, Xinyu Fang, Shengyuan Ding +5RL BenchmarksReinforcement Learning

  14. Causal Reinforcement Learning for Complex Card Games: A Magic The Gathering Benchmark

    May 7, 2026Cristiano da Costa Cunha, Ajmal Mian, Tim French +1RL BenchmarksStructural Causal Models

  15. Coopetition-Gym v1: A Formally Grounded Platform for Mixed-Motive Multi-Agent Reinforcement Learning under Strategic Coopetition

    May 3, 2026Vik Pant, Eric YuRL BenchmarksGame Theory

  16. Forager: a lightweight testbed for continual learning with partial observability in RL

    May 1, 2026Steven Tang, Xinze Xiong, Anna Hakhverdyan +7RL BenchmarksLoss of Plasticity

  17. Multi-action Tangled Program Graphs for Multi-task Reinforcement Learning with Continuous Control

    Apr 28, 2026Quentin Vacher, Nicolas Beuve, Mickaël Dardaillon +1RL BenchmarksGenetic Programming

  18. NASimJax: A GPU-Accelerated Policy Learning Framework for Penetration Testing

    Mar 20, 2026Raphael Simon, José Carrasquel, Elli Makdis Antoun +2RL BenchmarksPartially Observable RL

  19. Two-Bridge: Exclusive Objectives and Extended Horizon StarCraft II Benchmark

    Feb 19, 2026Sourav Panda, Tanmay Ambadkar, Shreyash Kale +2RL BenchmarksGame-Playing Agents

  20. Multi-Agent Reinforcement Learning for V2X Resource Allocation: Disentangling MARL Challenges Through Benchmarking

    Feb 18, 2026Siyuan Wang, Lei Lei, Pranav Maheshwari +2RL BenchmarksReinforcement Learning

  21. Beyond Success Rates: Trainability and Extractability for Offline GCRL

    Feb 5, 2026Jan Malte Töpperwien, Aditya Mohan, Marius LindauerRL BenchmarksOffline RL

  22. GraphAllocBench: A Flexible Benchmark for Preference-Conditioned Multi-Objective Policy Learning

    Jan 28, 2026Zhiheng Jiang, Yunzhe Wang, Ryan Marr +3Multi-Objective Reinforcement LearningRL Benchmarks

  23. KAGE-Bench: Fast Known-Axis Visual Generalization Evaluation for Reinforcement Learning

    Jan 20, 2026Egor Cherepanov, Daniil Zelezetsky, Alexey K. Kovalev +1RL BenchmarksReinforcement Learning

  24. The HydroGym Reinforcement Learning Platform for Fluid Dynamics

    Dec 19, 2025Christian Lagemann, Sajeda Mokbel, Miro Gondrum +18RL ControlRL Benchmarks

  25. Octax: Accelerated CHIP-8 Arcade Environments for Reinforcement Learning in JAX

    Oct 2, 2025Waris Radji, Thomas Michel, Hector PiteauRL BenchmarksReinforcement Learning

  26. HARL-A: An Extensible Benchmark Framework for Heterogeneous Multi-Agent Adversarial Reinforcement Learning in IsaacLab

    Sep 26, 2025Isaac Peterson, Christopher Allred, Jacob Morrey +1RL BenchmarksRobotic RL

  27. PuzzleJAX: A Benchmark for Reasoning and Learning

    Aug 22, 2025Sam Earle, Graham Todd, Yuchen Li +5RL BenchmarksGame-Playing Agents

  28. SafeOR-Gym: A Benchmark Suite for Safe Reinforcement Learning Algorithms on Practical Operations Research Problems

    Jun 2, 2025Asha Ramanujam, Adam Elyoumi, Hao Chen +5RL BenchmarksConstrained RL