Simulation-Based Reinforcement Learning

Latest papers 60

All topics
CardsList
  1. Factoriax: A GPU-Accelerated Factorio-Style Simulator for Reinforcement Learning

    Oct 4, 2026Mickey Beurskens, Tristan Tomilin, Thiago D. SimãoSimulation-Based Reinforcement Learning

  2. Network World Models as Environments for Algorithm Design on Complex Systems

    Oct 1, 2026Rishab Alagharu, Hongji Pu, Zeeshan Memon +3Efficient World-Action ModelAgent-Based Model

  3. Token-World: World Modeling in Vision-Language Model Token Space for Robot Manipulation

    Sep 30, 2026Chuyao Fu, Xiaowei Chi, Yuhan Rui +14Efficient World-Action ModelWorld Models

  4. From Learner Behavior to Reusable Skills for Effective and Efficient Learner Simulation

    Sep 29, 2026Zijian Chen, Zheng Zhang, Miao Jia +3User SimulationSimulation-Based Reinforcement Learning

  5. ARS: Agentic Reward System for Robot Learning

    Sep 28, 2026Sheng Hu, Weiyi Lu, Lingbing Zeng +5Scalable Robot LearningProgress Reward Modeling

  6. WTF?! Simulation-Free Reinforcement Learning with Wasserstein-Tilted Flow Maps

    Sep 22, 2026Abbas Mammadov, Jerry Y. Huang, Justin Lin +5Generative Flow NetworksReinforcement Fine-Tuning

  7. ReVeal: A Reconstruction-Aware Real-to-Sim Framework for VLA Policy Evaluation

    Sep 20, 2026Xinyi Wang, Heng Hao, Wenjun Hu +5Simulation-Based Reinforcement LearningEvaluation Benchmarks

  8. Proprioception-Anchored Cross-Modal Pretraining for Zero-Shot Sim-to-Real Contact-Rich Assembly

    Sep 7, 2026Yuhan Wang, Yurou Chen, Hongye Jiang +2Sim-To-Real Reinforcement LearningProprioception

  9. Measuring the Behavioral Fidelity of Long-Horizon Human Activity Simulations

    Sep 1, 2026Yi Fei Cheng, Fan Yang, Iremsu Bas +3User SimulationBehavioral Foundation Models

  10. One Frozen Simulator Is Not Enough: Simulator Collapse in Multi-Agent RL

    Aug 12, 2026Simon Yu, Nicholas Tomlin, Marwa Abdulhai +7Multi-Agent SimulationsSimulation-Based Reinforcement Learning

  11. V-Simba: Unleashing the Architectural Potential of RL in Visual Continuous Control

    Aug 8, 2026Donghu Kim, Youngdo Lee, Hojoon Lee +6Simulation-Based Reinforcement LearningScalable Robot Learning

  12. Simulation-free and finite-time diffusion model

    Aug 4, 2026Kentaro Kaba, Masayuki Ohzeki, Yuki SughiyamaDiffusion ModelsConditional Distribution

  13. CoRenew: A large language model agent-based policy simulation platform for multifamily residential redevelopment

    Jul 28, 2026Yudi Zhang, Yuming Lin, Li Tian +2Multi-Agent SimulationsNegotiation

  14. When Every Simulation Counts: Value-Based Reinforcement Learning for Accelerated Photonics Inverse Design

    Jul 26, 2026Longying Wen, Feiyang Wu, Jinglin Yu +3NanophotonicDeep Q-Networks

  15. Sling2Sim2Real: One-Shot Elastic System Identification for Non-Destructive Slingshot Policy Learning

    Jul 25, 2026Wonjae Kang, Geonwoo Kim, Minseok Song +1Sim-To-Real Reinforcement LearningSim-To-Real Gap

  16. Learning and Structurally Validating Simulation Scenario Continuations in Dynamic Graph Systems

    Jul 23, 2026Michael Romei de Socio, Gian Luca Pozzato, Alessio MerloScenario GenerationContinuation

  17. The Open Ant: A Robot Platform for Reinforcement Learning Research

    Jul 20, 2026Elena Sorina Lupu, Patrick Spieler, Khurram Javed +4Simulation-Based Reinforcement LearningEcosystems

  18. PAMD: Structured Adaptive Distances for Bisimulation Representations in Visual Reinforcement Learning

    Jul 20, 2026Daegyeong Roh, Juho Bae, Han-Lim ChoiSimulation-Based Reinforcement LearningDistance

  19. Step-Level Preference Learning for Generative Agents in Social Simulations

    Jul 16, 2026Wenchang Gao, Pingyue Sheng, Lanlan Qiu +7Preference LearningSimulation-Based Reinforcement Learning

  20. Learning Safe Agent Behaviour from Human Preferences and Justifications via World Models

    Jul 14, 2026Ilias Kazantzidis, Timothy J. Norman, Yali Du +1Simulation-Based Reinforcement LearningReward Functions

  21. Bridging Local Observation and Global Simulation in Closed-Loop Traffic Modeling

    Jun 30, 2026Ziyan Wang, Tan Xiang, Peng Chen +1Microscopic Traffic SimulationsTraffic

  22. What Probing Reveals about Autonomous Driving: Linking Internal Prediction Errors to Ego Planning

    Jun 30, 2026Hyeonchang Jeon, Kyungbeom Kim, Eugene Vinitsky +1Autonomous DrivingPrediction Error

  23. SimFoundry: Modular and Automated Scene Generation for Policy Learning and Evaluation

    Jun 26, 2026Nadun Ranawaka, Josiah Wong, Wei-Lin Pai +15Sim-To-Real Reinforcement LearningSimulation-Based Reinforcement Learning

  24. Position: RL Researchers Need to Distinguish Between Solving Simulators and Using Simulators as a Proxy

    Jun 26, 2026Matthew Vandergrift, Esraa Elelimy, Martha WhiteSimulation-Based Reinforcement LearningUser Simulation

  25. Superhuman AI for Generals.io Using Self-Play Reinforcement Learning

    Jun 22, 2026Matej Straka, Viliam Lisý, Martin SchmidSelf-PlaySimulation-Based Reinforcement Learning

  26. Learning User Simulators with Turing Rewards

    Jun 17, 2026Yingshan Susan Wang, Cedegao E. Zhang, Linlu Qiu +5User SimulationSimulation-Based Reinforcement Learning

  27. ReactSim-Bench: Benchmarking Reactive Behavior World Model Simulation in Autonomous Driving

    Jun 12, 2026Zhiyuan Zhang, Yanlun Peng, Jianing Zhang +7Autonomous Driving SimulationAutonomous Driving

  28. TacCoRL: Integrating Tactile Feedback into VLA via Simulation

    Jun 10, 2026Siyu Ma, Yuqi Liang, Chang Yu +5TactileSimulation-Based Reinforcement Learning

  29. PLUME: Probabilistic Latent Unified World Modeling and Parameter Estimation for Multi-Finger Manipulation

    Jun 9, 2026Abhinav Kumar, Soshi Iba, Rana Soltani Zarrin +1Latent World ModelsSimulation-Based Reinforcement Learning

  30. HARBOR: A Harness Framework for Agentic Robot Reinforcement Learning

    Jun 7, 2026Zechu Li, Yufeng Jin, Xiaoyang Liu +4Scalable Robot LearningSimulation-Based Reinforcement Learning

  31. Agentic Monte Carlo: Simulating Reinforcement Learning for Black-Box Agents

    Jun 3, 2026Dae Yon Hwang, Raunaq Suri, Valentin Villecroze +4Agentic Reinforcement LearningLarge Language Model Agents

  32. AgentCVR: Active Multi-Agent Cross-Video Reasoning via Script-Simulated Reinforcement Learning

    May 28, 2026Yilun Qiu, Jiahe Wang, Cilin Yan +4Multimodal AgentsSimulation-Based Reinforcement Learning

  33. Theoretical Foundations and Effective Algorithms for Policy-Aware Simulator Learning

    May 27, 2026Christoph Dann, Yishay Mansour, Mehryar MohriSimulation-Based Reinforcement LearningModel-Based Reinforcement Learning

  34. Accelerating Reinforcement Learning Training Using Simulation Surrogate Models

    May 26, 2026Mohammadmahdi Ghasemloo, David J. Eckman, Yaxian LiSimulation-Based Reinforcement LearningSurrogate Models

  35. MobileGym: A Verifiable and Highly Parallel Simulation Platform for Mobile GUI Agent Research

    May 25, 2026Dingbang Wu, Rui Hao, Haiyang Wang +8SkillgymSimulation-Based Reinforcement Learning

  36. Robotic Strawberry Harvesting with Robust Vision and Deep Reinforcement Learning based Sim-to-Real Control

    May 22, 2026Al Bashir, Shao-Yang Chang, Partho Ghose +3Agricultural RoboticsSimulation-Based Reinforcement Learning

  37. Mind the Sim-to-Real Gap & Think Like a Scientist

    May 20, 2026Harsh Parikh, Gabriel Levin-Konigsberg, Dominique Perrault-Joncas +1Simulation-Based Reinforcement LearningSim-To-Real Gap

  38. FutureSim: Replaying World Events to Evaluate Adaptive Agents

    May 14, 2026Shashwat Goel, Nikhil Chandak, Arvindh Arun +5Simulation-Based Reinforcement LearningReplay

  39. Controllable User Simulation

    May 12, 2026Guy Tennenholtz, Ofer Meshi, Amir Globerson +3User SimulationSimulation-Based Reinforcement Learning

  40. Beyond Self-Play: Hierarchical Reasoning for Continuous Motion in Closed-Loop Traffic Simulation

    May 9, 2026Weifan Zhang, Xiaofeng Zhao, Adel Bazzi +3Microscopic Traffic SimulationsMulti-Agent Reinforcement Learning

  41. EnvSimBench: A Benchmark for Evaluating and Improving LLM-Based Environment Simulation

    May 8, 2026Yi Liu, TingFeng Hui, Wei Zhang +4Synthetic EnvironmentsSimulation-Based Reinforcement Learning

  42. Using Common Random Numbers for Simulation-based Planning with Rollouts

    May 6, 2026Sandarbh Yadav, Frederic J Maliakkal, Harshad Khadilkar +1RandomSimulation-Based Reinforcement Learning

  43. Physics-Guided Dimension Reduction for Simulation-Free Operator Learning of Stiff Differential-Algebraic Systems

    Apr 21, 2026Huy Hoang Le, Haoguang Wang, Christian Moya +2Ordinary Differential EquationsJacobian

  44. SOCIA-EVO: Automated Simulator Construction via Dual-Anchored Bi-Level Optimization

    Apr 19, 2026Yuncheng Hua, Sion Weatherhead, Mehdi Jafari +2AlphaevolveSimulation-Based Reinforcement Learning

  45. Meituan Merchant Business Diagnosis via Policy-Guided Dual-Process User Simulation

    Apr 16, 2026Ziyang Chen, Renbing Chen, Daowei Li +4User SimulationSimulation-Based Reinforcement Learning

  46. WoVR: World Models as Reliable Simulators for Post-Training VLA Policies with RL

    Feb 15, 2026Zhennan Jiang, Shangqing Zhou, Yutong Jiang +11Video World ModelsSimulation-Based Reinforcement Learning

  47. Posterior-driven Heuristic Support Adaptation in a Probabilistic Treatment of Real2Sim2Real for Vision-Driven Deformable Linear Object Manipulation

    Oct 30, 2025Georgios Kamaras, Craig Innes, Subramanian RamamoorthyDeformable Linear ObjectsInference-Time Steering

  48. Simulation-free Structure Learning for Stochastic Population Dynamics

    Oct 18, 2025Noah El Rimawi-Fine, Adam Stecklov, Lucas Nelson +4Population DynamicsStochastic Dynamics

  49. Climate Surrogates for Scalable Multi-Agent Reinforcement Learning: A Case Study with CICERO-SCM

    Oct 9, 2025Oskar Bohn Lassen, Serio Angelo Maria Agriesti, Filipe Rodrigues +2Multi-Agent Reinforcement LearningSimulation-Based Reinforcement Learning

  50. AgentDynEx: Nudging the Mechanics and Dynamics of Multi-Agent Simulations

    Apr 13, 2025Jenny Ma, Riya Sahni, Karthik Sreedhar +1Multi-Agent SimulationsUser Simulation