Visuomotor Policy Learning

Momentum

43 papers in the last four weeks, up 378% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 209

All topics
CardsList
  1. LoopVLA: Learning Sufficiency in Recurrent Refinement for Vision-Language-Action Models

    May 11, 2026Boyang Shen, Kaixiang Yang, Hao Wang +4Efficient VLM InferenceEfficient VLA Model Inference

  2. BEACON: Cross-Domain Co-Training of Generative Robot Policies via Best-Effort Adaptation

    May 9, 2026Antong Zhang, Han Qi, Heng YangSynthetic-to-Real Domain AdaptationRobot Policy Learning

  3. Trajectory-Consistent Flow Matching for Robust Visuomotor Policy Learning

    May 8, 2026Riad Ahmed, Sujosh Nag, Moniruzzaman Akash +2Flow MatchingRobot Policy Learning

  4. Hyper-DP3: Frequency-Aware Right-Sizing of 3D Diffusion Policies for Visuomotor Control

    May 2, 2026Jinhao Zhang, Zhexuan Zhou, Huizhe Li +5Visuomotor Policy LearningDiffusion Policy

  5. To Do or Not to Do: Ensuring the Safety of Visuomotor Policies Learned from Demonstrations

    May 2, 2026Riad Ahmed, Moniruzzaman Akash, Momotaz BegumVisuomotor Policy LearningImitation Learning

  6. MSACT: Multistage Spatial Alignment for Stable Low-Latency Fine Manipulation

    May 1, 2026Xianbo Cai, Hideyuki Ichiwara, Masaki Yoshikawa +1Bimanual Robotic ManipulationVisuomotor Policy Learning

  7. Stereo Multistage Spatial Attention for Real-Time Mobile Manipulation Under Visual Scale Variation and Disturbances

    May 1, 2026Xianbo Cai, Hideyuki Ichiwara, Hyogo Hiruma +3Mobile ManipulationVisuomotor Policy Learning

  8. CF-VLA: Efficient Coarse-to-Fine Action Generation for Vision-Language-Action Policies

    Apr 27, 2026Fan Du, Feng Yan, Jianxiong Wu +8Robotic ControlEfficient VLA Model Inference

  9. FingerViP: Learning Real-World Dexterous Manipulation with Fingertip Visual Perception

    Apr 23, 2026Zhen Zhang, Weinan Wang, Hejia Sun +4Dexterous ManipulationVisuomotor Policy Learning

  10. Gated Memory Policy

    Apr 21, 2026Yihuai Gao, Jinyun Liu, Shuang Li +1Sequential Decision MakingVisuomotor Policy Learning

  11. R3D: Revisiting 3D Policy Learning

    Apr 16, 2026Zhengdong Hong, Shenrui Wu, Haozhe Cui +83D ViTsVisuomotor Policy Learning

  12. DockAnywhere: Data-Efficient Visuomotor Policy Learning for Mobile Manipulation via Novel Demonstration Generation

    Apr 16, 2026Ziyu Shan, Yuheng Zhou, Gaoyuan Wu +3Mobile ManipulationGeneralization in Robotic Manipulation

  13. VolumeDP: Modeling Volumetric Representation for Manipulation Policy Learning

    Mar 18, 2026Tianxing Zhou, Feiyang Xue, Zhangchen Ye +3Visuomotor Policy LearningRobotic Manipulation

  14. MoE-ACT: Scaling Multi-Task Bimanual Manipulation with Sparse Task-Conditioned Mixture-of-Experts Transformers

    Mar 16, 2026Kangjun Guo, Haichao Liu, Yanji Sun +3Bimanual Robotic ManipulationVisuomotor Policy Learning

  15. Foundation and Small Models Coordination for Visuomotor Policy Learning

    Mar 9, 2026Haoran Ding, Liang Ma, Yaxun Yang +7Visuomotor Policy LearningRobot Policy Generalization

  16. Mind the Gap: Rethinking I/O Design for Contact-Rich Visuomotor Policy Learning

    Feb 9, 2026Cuijie Xu, Shurui Zheng, Zihao Su +7Contact-Rich Robotic ManipulationRobot Teleoperation

  17. Think Proprioceptively: State-Grounded Visual Token Selection for VLA Policies

    Feb 6, 2026Fangyuan Wang, Peng Zhou, Jiaming Qi +4Efficient VLM InferenceVisuomotor Policy Learning

  18. PACT-WAM: Predicting Actions and Visual Foresight with Compact Temporal Encoding for Robot Manipulation

    Feb 5, 2026Yushan Liu, Jingjing Fan, Shoujie Li +3World Models for RoboticsVisuomotor Policy Learning

  19. HiMoE-VLA: Hierarchical Mixture-of-Experts for Generalist Vision-Language-Action Policies

    Dec 5, 2025Zhiying Du, Bei Liu, Yaobo Liang +7Visuomotor Policy LearningVision-Language-Action Models

  20. SeFA-Policy: Fast and Accurate Visuomotor Policy Learning with Selective Flow Alignment

    Nov 11, 2025Rong Xue, Jiageng Mao, Mingtong Zhang +1Rectified FlowVisuomotor Policy Learning

  21. Posterior-driven Heuristic Support Adaptation in a Probabilistic Treatment of Real2Sim2Real for Vision-Driven Deformable Linear Object Manipulation

    Oct 30, 2025Georgios Kamaras, Craig Innes, Subramanian RamamoorthySimulation-Based InferenceAdaptive Inference

  22. eVGGT: An Efficient Geometry-Aware Vision Encoder for Visuomotor Policies

    Sep 19, 2025An Dinh Vuong, Minh Nhat Vu, Ian ReidVisual Representation LearningVisuomotor Policy Learning

  23. Look, Focus, Act: Efficient and Robust Robot Learning via Human Gaze and Foveated Vision Transformers

    Jul 21, 2025Ian Chuang, Jinyu Zou, Andrew Lee +2Visuomotor Policy LearningEfficient ViTs

  24. Wavelet Policy: Imitation Learning in the Scale Domain with World Prior Memory

    Apr 7, 2025Changchuan Yang, Haoxuan Xu, Yuhang Dong +3Latent Action LearningVisuomotor Policy Learning

  25. FiberTune: Preserving Action-Fiber Visual Residuals in Vision-Language-Action Fine-Tuning

    Date pendingHaihao Lin, Xiangsheng Huang, Xiao Yang +7Representation LearningVLM Adaptation