Visuomotor Policy Learning

Momentum

43 papers in the last four weeks, up 378% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 209

All topics
CardsList
  1. Video Prediction Policy 2: Predict Better, Act Better

    Oct 7, 2026Yanjiang Guo, Haodong Yan, Zhide Zhong +15Visuomotor Policy LearningWorld Action Models

  2. CAP: Codebook-Aligned Prediction for Tokenized Robot Policies

    Oct 6, 2026Haoran Chen, Jingtian Ji, Samuel Wheeler +2Robot Policy LearningRobot Learning

  3. MIM-VLA: Learning Physical Interaction Representations from Gripper Motor Feedback

    Oct 6, 2026Jaeyoung Lee, Jiyeon Koo, Taehwa Kim +2Robotic GraspingVisuomotor Policy Learning

  4. IronMan: Information-Constrained Video-Action Learning for Robot Manipulation

    Oct 6, 2026Yuanshuo Zhang, Wenzhe Zhao, Zixing Lei +2Information BottleneckGeneralization in Robotic Manipulation

  5. Bilinear Flow Policy: Distributional Extrapolation for Goal-Conditioned Visuomotor Imitation

    Oct 5, 2026Wonsuhk Jung, Sundhar Vinodh Sangeetha, Chen Xu +4OOD GeneralizationVisuomotor Policy Learning

  6. Learning Coordinated Visuomotor Box-Pushing from Solo Demonstrations

    Oct 5, 2026Ryusei Matsumoto, Mei Kinjo, Yoko Sasaki +1Visuomotor Policy LearningMulti-Robot Coordination

  7. VAMPS: Visual and Motor Policies from Sampling-Based Planning

    Oct 4, 2026Mohamed Yassine Kabouri, Pietro Noah Crestaz, Quang-Nam Nguyen +3Robot Policy LearningVisuomotor Policy Learning

  8. Whole-Body Aerial Grasping and Lifting via Partial Visual Observations

    Sep 30, 2026Jiaye Jin, Rui Jin, Xinhang Xu +6Aerial RoboticsPartially Observable RL

  9. Text-to-3D Policy: Fine-Grained Language-Behavior Alignment for Unseen Specification Generalization

    Sep 30, 2026Xinhao Yang, Wenhao Wu, Ning Lv +5Language-Conditioned Robot ManipulationGeneralization in Robotic Manipulation

  10. MotionWeave: Learning Motion-Centered Future Dynamics for Vision-Language-Action Policies

    Sep 30, 2026Jingqiu Wang, Yan WangVisuomotor Policy LearningRobotic Manipulation

  11. A Biophysically Detailed C. elegans Circuit as a Task-Agnostic Dynamical Core for Visually Robust Robot Manipulation

    Sep 30, 2026Linrui Qian, Jiajia Zhang, Gan He +7Robotic ControlRobot Policy Learning

  12. BIND: Binding 3D Robot Actions to 2D Image Features

    Sep 29, 2026Cameron Smith, Arsh Tangri, Vitor Guizilini +3Visuomotor Policy LearningData-Efficient Robot Learning

  13. Rethinking Representations for World-Action Modeling

    Sep 29, 2026Haoyi Jiang, Liu Liu, Xinjiang Wang +12World Model LearningAction-Conditioned World Models

  14. Remember What You Did: Action-History Memory with Dual-Expert Denoising for Long-Horizon Vision-Language-Action Policies

    Sep 29, 2026Yaxin Zhao, Dianye Huang, Chenwei Wang +2Memory-Augmented VLMsLong-Horizon Robotic Manipulation

  15. V-JEPA Policy: Building Effective World-Action Models on Predictive Visual Latents

    Sep 29, 2026Yang Zhang, Jiangyuan Zhao, Chenyou Fan +4Visual Representation LearningVisuomotor Policy Learning

  16. ComManip: Overfitting Manipulation Policies to Comfortable Regions

    Sep 29, 2026Yidan Lai, Xinyi Chen, Shuquan Man +1Visuomotor Policy LearningRobotic Manipulation

  17. LexiconVLA: Learning Reusable Atomic Action Codebooks for Unseen Tasks

    Sep 29, 2026Zeming Wei, Jianheng Ye, Xinshuai Song +3Visuomotor Policy LearningRobotic Manipulation

  18. Where Predictive Supervision Goes Shapes What VLA Policies Learn

    Sep 29, 2026Hanseul Kim, Jewon Yeom, Youngjoon Jeong +2Visuomotor Policy LearningVision-Language-Action Models

  19. Gaze Prompts: Temporally Dense Human Attention for Vision-Language-Action Fine-Tuning

    Sep 28, 2026Yihan Zhou, Rui Yan, Mingcong Li +4Visuomotor Policy LearningRobotic Manipulation

  20. Quantile Head for Vision-Language-Action Models

    Sep 28, 2026Xuan Wang, Yinan Wu, Haoran Duan +1Quantile RegressionEfficient VLA Model Inference

  21. Estimate, Don't Imitate: Reusing Differentiable State-Based Policies for Visuomotor Control

    Sep 27, 2026Denis Shcherba, Adrian Abel, Eckart Cobo-Briesewitz +3Visuomotor Policy LearningRobotic Manipulation

  22. SLIP-VLA: Single-Step Latent Imagination for Policy Learning in Vision-Language-Action Models

    Sep 27, 2026Tianfu Li, Haoxuan Xu, Wenbo Chen +7World Model LearningVisuomotor Policy Learning

  23. Faster Visuomotor Policy Learning on Action Manifolds via Riemannian MeanFlow

    Sep 24, 2026S. Talha Bukhari, Austin Garrett, Yi Wei +3Visuomotor Policy LearningRiemannian Flow Matching

  24. ActGaze: Learning Action-Grounded Gaze through Counterfactual Visual Interventions for High-Precision Manipulation

    Sep 24, 2026Jinxuan Zhu, Jiaheng Wang, Chao Tang +7Visuomotor Policy LearningRobotic Manipulation

  25. Morphometric Imitation: From Morphology and Contact Aware Hand Retargeting to Sim-to-Real Visuomotor Policy

    Sep 23, 2026Tara Sadjadpour, Siming He, C. K. Wolfe +5Zero-Shot Robotic ManipulationContact-Rich Robotic Manipulation

  26. MAVP: Map-Aware Visuomotor Policies for Mobile Manipulation

    Sep 22, 2026Jinhe Tang, Ruixiao Dai, Weiming ZhiRobot Trajectory TrackingRobot Policy Learning

  27. An Action Is Worth One Patch: Unified World-Action Modeling with PatchWAM

    Sep 22, 2026Tianheng Wang, Zhou Xie, Heng Jia +3World Models for RoboticsVisuomotor Policy Learning

  28. RoboMP-DINOv2: Prompts, Not Filters for Robust Robot Manipulation

    Sep 22, 2026Han Qi, Heng YangGeneralization in Robotic ManipulationVisuomotor Policy Learning

  29. Visuomotor Robotic Pruning in Planar Orchards Using Hybrid Reinforcement Learning

    Sep 21, 2026Abhinav Jain, Cindy Grimm, Stefan LeeVisuomotor Policy LearningRobotics

  30. ARSTAG: An Agentic Real2Sim2Real System for Task-Specific Robot Data Generation

    Sep 21, 2026Bowei Li, Yuner Zhang, Changliu LiuRobotics SimulationSim-to-Real Transfer

  31. Object-Centric Conditioning for Visuomotor Flow Matching

    Sep 21, 2026Jijie Li, Xu Yang, Junhong Zou +4Flow MatchingVisuomotor Policy Learning

  32. Accelerating Visual Policy Learning with Sampling-Based Model Predictive Control

    Sep 17, 2026Yilang Liu, Haoxiang You, Qian Wang +2Policy OptimizationVisuomotor Policy Learning

  33. AnyViewDex: View-Invariant Dexterous Manipulation from RGB Observations

    Sep 17, 2026Soham Patil, Om Sanjay Gunjal, Sourabh Bhosale +3Robotic GraspingZero-Shot Robotic Manipulation

  34. ViLoMan: Learning Visual-Proprioceptive Whole-Body Loco-Manipulation Skills for Humanoid Robots

    Sep 16, 2026Zejie Tian, Ruibing Hou, Bingpeng Ma +2Humanoid Loco-ManipulationHumanoid Robot Control

  35. Decoupling Vision, Language, and Action for Efficient Multi-Task Robot Policies

    Sep 16, 2026Xiatao Sun, Chen Liang, Ziyao Zeng +5Visuomotor Policy LearningEfficient VLA Models

  36. ULOHA: An Underwater Bimanual Robot System for Robot Learning

    Sep 16, 2026Masato Kobayashi, Takeru TsunooriBimanual Robotic ManipulationVisuomotor Policy Learning

  37. Rethinking Visual Embodiment Dependence in Visuomotor Policies

    Sep 15, 2026Hongjie Fang, Yuxuan Lu, Chenxi Wang +8Generalization in Robotic ManipulationVisuomotor Policy Learning

  38. UniDex-ViTac: Learning Unified Visuo-Tactile Dexterous Manipulation Policy from Human Video Data

    Sep 15, 2026Hyesung Lee, Si-Hwan Heo, Sungwook YangRL for RoboticsVisuomotor Policy Learning

  39. Uncertainty-Guided Sparse Refinement for Action Chunking Transformer Policies

    Sep 14, 2026Chenyang Wang, Yuntian Wang, Xiaoxiong Yang +3Long-Horizon Robotic ManipulationVisuomotor Policy Learning

  40. StereoPatch: Patch-Aligned RGB-Depth Fusion for Spatial Perception in Robot Manipulation

    Sep 14, 2026Yanan Zhou, Zhaoyan Qian, James Zhao +1Generalization in Robotic ManipulationVisuomotor Policy Learning

  41. Visible Touch: Rendering Contact for Visuomotor Policies

    Sep 12, 2026Metin Alp Dogan, Edward Sun, Feng Xu +4Visuomotor Policy LearningTactile Sensing for Robotic Manipulation

  42. UniMPA: A Unified Memory-Prediction-Action Model via Action-Grounded Transition Modeling

    Sep 11, 2026Wei Li, Rui Shao, Jie He +3Memory-Augmented VLMsVisuomotor Policy Learning

  43. MoPA: Coordinated Mobile Manipulation via Subsystem-Specific Perception Alignment

    Sep 10, 2026Guangyu Chen, Qiwei Liang, Shaolong Zhu +7Mobile ManipulationCross-Modal Alignment

  44. Localized Visual Feature Aggregation via Focus Pooling for Visuomotor Policies

    Sep 8, 2026Ruiyu Wang, Zheyu Zhuang, Danica Kragic +1Visuomotor Policy LearningVision-Based Robot Control

  45. LayerRoute: Action-Conditioned Mixture-of-Layers Routing for Vision-Language-Action Policies

    Sep 5, 2026Zheng Lu, Haoran Liao, Wanqi Zhong +9Visuomotor Policy LearningRobotic Manipulation

  46. MINERVA: How Small Can a Manipulation Policy Be and Still Solve LIBERO?

    Sep 3, 2026Kohei Sendai, Tatsuya Matsushima, Yusuke IwasawaRobot Skill LearningVisuomotor Policy Learning

  47. PAVE: Predictive Alignment and Value-Guided Evolution for World-Action Policies

    Aug 31, 2026Botong Zhao, Fang Yu, Tim Yu +3Robot Policy LearningRobot Skill Learning

  48. DriftingVLA: Native One-Step Vision-Language-Action Generation via Per-Dimension Temporal Drifting

    Aug 30, 2026Yuxuan Gao, Shiqi Zhang, Yedong Shen +6Efficient VLA Model InferenceVisuomotor Policy Learning

  49. VT-MUSE: Multimodal Unified Sequential Visuotactile Representation Learning for Manipulation

    Aug 21, 2026Congsheng Xu, Qiaochu Yang, Fangyuan Shi +9Visuo-Tactile Representation LearningVisuomotor Policy Learning

  50. Attention from Action, for Action: Emergent Visual Bottlenecks for Policy Learning

    Aug 13, 2026Zheyu Zhuang, Ruiyu Wang, Nick Heppert +4Visual AttentionVisuomotor Policy Learning

  51. NestDex: Nested Policy Learning with Copilot Assisted Teleoperation for Dexterous Manipulation

    Aug 13, 2026James Zhao, Jinhe Tang, Mingyuan Ba +1Robot TeleoperationVisuomotor Policy Learning

  52. Foresight Without Seeing: Latent Futures for World Action Models

    Aug 12, 2026Jiakai Huang, Zhongbo Wu, Siyu Xu +5World Models for RoboticsVisuomotor Policy Learning

  53. Surgical WAM: A World-Action Model for Data-Efficient Surgical Robot Learning

    Aug 11, 2026Wenrui Bao, Tianyun Jiang, Zhiben Chen +3World Models for RoboticsBimanual Robotic Manipulation