Visuomotor Policy Learning

Momentum

43 papers in the last four weeks, up 378% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 209

All topics
CardsList
  1. Vid2WAM: Distilling Video Diffusion Priors into World Action Models

    Aug 9, 2026Chenhao Qiu, Ruixiang Wang, Runyi Zhao +7Cross-Modal Knowledge DistillationWorld Model Learning

  2. ARGUS: Aligning Robot Scene Geometry Under Shifting Views with Large 3D Vision Models

    Aug 6, 2026Rishik Sathua, Haonan Chen, Katherine Driggs-CampbellGeneralization in Robotic ManipulationVisuomotor Policy Learning

  3. Track4Action: Distilling World-Centric 3D Tracker into Vision-Language-Action Policies

    Aug 4, 2026Chenyi Wang, Xinkai Wang, Bokai Lin +4Visuomotor Policy LearningVision-Language-Action Models

  4. Unified Visuomotor Targets: Supervising VLAs Beyond Physical Actions

    Aug 4, 2026Zhenyang Feng, Unnat JainLatent Action LearningVisuomotor Policy Learning

  5. UniNav: A Unified World-Action Diffusion Model for Visual Navigation

    Aug 4, 2026Changqing Zhou, Yueru Luo, Zeyu Jiang +1Visual NavigationTrajectory Generation

  6. Probabilistic Reachable-Action Verification of Visuomotor Policies via Set-Based Training

    Aug 3, 2026Yanliang Huang, Zhuocheng Zhang, Peng Xie +5Visuomotor Policy Learning

  7. RayViT: Ray-Conditioned Visual Representations for Viewpoint-Robust Imitation Learning

    Jul 31, 2026Qian Wang, Longrui Chen, Peiran Sun +8Visual Representation LearningRobot Skill Learning

  8. Temporal Policy: History-Initialized Action Generation for Robotic Learning from Demonstration

    Jul 31, 2026Dylan Miller, Martin JagersandFlow MatchingRobot Policy Learning

  9. FA-RDP: A Frequency-Adaptive Reactive Diffusion Policy for Contact-Rich Manipulation

    Jul 30, 2026Lifeng Zhuo, Wendi Chen, Han Xue +4Contact-Rich Robotic ManipulationVisuomotor Policy Learning

  10. DLAM: Distributional Latent Actions with Temporal Constraints

    Jul 29, 2026Zuojin Tang, Feifan Luo, Haoyun Liu +10Latent Action LearningLatent Dynamics Modeling

  11. πR2π\mathbf{R}^2: Reactive Real-time Flow Policies

    Jul 28, 2026Sungjae Park, Shubham TulsianiRobotic ControlFlow Matching

  12. DC-WAM: Dynamic-Centric Visual Supervision and Reasoning for World-Action Models

    Jul 28, 2026Haoyuan Ji, Lingxiang Fan, Shang Su +4World Models for RoboticsVisuomotor Policy Learning

  13. Tri-Manual Visuomotor Imitation Learning of Robot Policies

    Jul 28, 2026James Zhao, Mingyuan Ba, Weiming ZhiRobot TeleoperationVisuomotor Policy Learning

  14. Decompose and Reorganize: Planning with Primitives and Visuomotor Policies Learned from Demonstrations

    Jul 28, 2026Yizhou Chen, Hang Xu, Dongjie Yu +7Long-Horizon Robotic ManipulationRobot Skill Learning

  15. DeVA: Decoupled Video-Action Model with physical guidance for robot policy learning

    Jul 27, 2026Mengqi Zhang, Sahil Khose, Simar Kareer +3Visuomotor Policy LearningVision-Language-Action Models

  16. GuidedAttention: Interpretable and Correctable Visual Attention for OOD-Robust Robot Manipulation via Imitation Learning

    Jul 23, 2026Masaki Murooka, Ryoichi Nakajo, Keisuke Shirai +4Visual AttentionRobot Skill Learning

  17. Ordered Action Tokens for Visuomotor Policy Learning

    Jul 23, 2026Chaoqi Liu, Yue Zhao, Haonan Chen +4Visuomotor Policy Learning

  18. Patch Policy: Efficient Embodied Control via Dense Visual Representations

    Jul 20, 2026Gaoyue Zhou, Zichen Jeff Cui, Ada Langford +3Visuomotor Policy LearningRobot Learning

  19. Dynamics-Aware Meta-Imitation for Generalization to Unseen Robotic Manipulation

    Jul 17, 2026Zhenduo Shang, Xiyao Liu, Bohan Li +4Robot Skill LearningGeneralization in Robotic Manipulation

  20. FoMoVLA: Bridging Visual Foresight and Motion Guidance for Vision-Language-Action Models

    Jul 16, 2026Wei Li, Peijin Jia, Yuan Ma +9Visuomotor Policy LearningVision-Language-Action Models

  21. ChunkFlow: Towards Continuity-Consistent Chunked Policy Learning

    Jul 14, 2026Zhao Yang, Yinan Shi, Mingyuan Yao +3Visuomotor Policy LearningVision-Language-Action Models

  22. See like a Robot: Robot-Centric Pointmaps for VLA Models

    Jul 13, 2026Byungkun Lee, Dongyoon Hwang, Dongjin Kim +4Visuomotor Policy LearningRobotic Manipulation