Visual RL

RL: Reinforcement Learning

Momentum

5 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 43

All topics
CardsList
  1. Directed Temporal Representations for Offline Visual Control

    Oct 6, 2026Chenyang Yuan, Haoyu Wang, Zhuo Sun +1Visual RLTrajectory Representation Learning

  2. Same Reward, Different Skills: When Multimodal RL Learns to Look

    Oct 1, 2026Haocun Ye, Xinlong Jiang, Qile Chen +6Reinforcement Learning with Verifiable RewardsVisual Grounding

  3. Disagreement-Regularized Imitation Learning for Image-Based Continuous Control with Gaussian and Beta Policies

    Sep 29, 2026Irving Giovani Bronzatti Petrazzini, Eric Aislan AntoneloImitation LearningBehavior Cloning

  4. SCA: Spatial Credit Assignment for Reinforcement Learning of GUI Agents

    Sep 29, 2026Shengtian Yang, Ziyu Xiong, Kaibing Yang +6Reinforcement LearningRL for GUI Agents

  5. Intrinsic Robot Rewarding: Reusing VLA Representations for Autonomous Evaluation and Policy Improvement

    Sep 15, 2026Tobias Schaffer, Mohab Elkhayat, Daniela Nicklas +2RL for RoboticsIntrinsic Reward Methods

  6. LettuceVisSim: A Simulator That Generates Lettuce Image Time-series for Vision-Based Reinforcement Learning

    Sep 14, 2026Ziye Zhu, Bert van 't Ooster, Congcong Sun +2Synthetic Data GenerationImage Generation

  7. Selective Agent Guidance via Entropy: Learning Autonomous Policies from Imperfect VLM Teachers

    Sep 1, 2026Giovanni Bonetta, Matteo Merler, Davide Zago +2Uncertainty SamplingVisual RL

  8. Graph Neural Assisted Actor-Critic for Latency-Efficient Edge Vision System

    Aug 17, 2026Alam Noor, Luis Almeida, Kai Li +3Aerial RoboticsEdge Computing

  9. V-Simba: Unleashing the Architectural Potential of RL in Visual Continuous Control

    Aug 8, 2026Donghu Kim, Youngdo Lee, Hojoon Lee +6Reinforcement LearningVisual RL

  10. Aftab: A Progressive Design Study of Visual Encoders and Value Estimation for Replay-Free Parallelized Q-Learning

    Aug 7, 2026Taha Shieenavaz, Shabnam Zareshahraki, Loris NanniDeep Q-LearningQ-Learning

  11. TaskSense: Focusing on What Matters in World Models

    Aug 6, 2026SM Mazharul Islam, Manfred HuberWorld Model LearningWorld Models

  12. Observation-Grounded Self-Predictive Reinforcement Learning for Visual Continuous Control

    Aug 6, 2026Xinwei Liu, Junyuan Liang, Jianting Zhang +1Predictive Representation LearningContinuous Control

  13. Anticipatory Risk-Guided Reinforcement Learning for Safe Flight Through Dynamic Clutter

    Jul 26, 2026Yuchao Mei, Guohao Zhang, Luxia Ai +2Collision AvoidanceRisk-Sensitive RL

  14. PAMD: Structured Adaptive Distances for Bisimulation Representations in Visual Reinforcement Learning

    Jul 20, 2026Daegyeong Roh, Juho Bae, Han-Lim ChoiMahalanobis DistanceMetric Learning

  15. UniVR: Thinking in Visual Space for Unified Visual Reasoning

    Jul 14, 2026Zhongwei Ren, Yunchao Wei, Yao Zhao +5Physical ReasoningVisual Spatial Reasoning

  16. Mask-based Predictive Representations for Reinforcement Learning

    Jul 5, 2026Kai ZhaoRepresentation LearningPredictive Representation Learning

  17. Local Motion Matters: A Deconstruct-Recompose Paradigm for Reinforcement Learning Pre-training from Videos

    Jul 1, 2026Jinwen Wang, Youfang Lin, Xiaobo Hu +2Cross-Embodiment Robot LearningRobotic RL

  18. Task-Relevant Representation Decoupling for Visual Reinforcement Learning Generalization

    Jul 1, 2026Jinwen Wang, Youfang Lin, Xiaobo Hu +4Representation LearningRepresentation Learning for RL

  19. Stage-Transition Dense Reward Modeling for Reinforcement Learning

    Jun 30, 2026Yang Yang, Bingjie Chen, Zihan Wang +4RL for RoboticsLong-Horizon Robotic Manipulation

  20. Staged Hybridisation for Visual Quantum Reinforcement Learning via Knowledge Distillation

    Jun 29, 2026Javier Lazaro, Juan-Ignacio Vazquez, Pablo Garcia-BringasHybrid Quantum-Classical MLVariational Quantum Circuits

  21. Domain Adaptation with Adaptive Imagination for Visual Reinforcement Learning under Limited Target Data

    Jun 29, 2026Hyunwoo Park, Sang-Hyun LeeSynthetic-to-Real Domain AdaptationFew-Shot Domain Adaptation

  22. Motion-Aware Reinforcement Learning For Object Localization

    Jun 19, 2026Prithvi Raj Singh, Satyendra SinghObject DetectionVisual RL

  23. Reinforcement Learning from Cross-domain Videos with Video Prediction Model

    Jun 2, 2026Zhao Yang, Xinrui Zu, Jacob E. Kooi +5RL for RoboticsImitation Learning

  24. Learning to See via Epiretinal Implant Stimulation in silico with Model-Based Deep Reinforcement Learning

    Jun 2, 2026Jacob Lavoie, Marwan Besrour, William Lemaire +3Visual RL

  25. TRON: Targeted Rule-Verifiable Online Environments for Visual Reasoning RL

    Jun 1, 2026Tianze Yang, Yucheng Shi, Ruitong Sun +3Reinforcement LearningVLM Reasoning

  26. Efficient On-policy Visual-RL via Stochastic Decoupled Policy Gradient

    May 26, 2026Haoxiang You, Yilang Liu, Davis Zong +5Policy OptimizationVisuomotor Policy Learning

  27. Does Seeing More Mean Knowing More? Mono-Anchored Advantage Normalization for Multi-Source Visual Reasoning

    May 25, 2026Fanhu Zeng, Zhicong Luo, Zefan Wang +3Visual ReasoningMultimodal Reasoning

  28. JAXenstein: Accelerated Benchmarking for First-Person Environments

    May 19, 2026Ruo Yu Tao, George KonidarisRL BenchmarksPartially Observable RL