Visuomotor Control

Momentum

7 papers in the last four weeks, with none the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 35

All topics
CardsList
  1. Estimate, Don't Imitate: Reusing Differentiable State-Based Policies for Visuomotor Control

    Sep 27, 2026Denis Shcherba, Adrian Abel, Eckart Cobo-Briesewitz +3Visuomotor PolicyTemporally Coherent Imitation Learning

  2. VGM-VS: Rethinking Visual Geometry Model for High-Precision Visual Servoing

    Sep 23, 2026Yimin Pan, Sen Wang, You Zhou +4Visual ServoingVisuomotor Control

  3. An Action Is Worth One Patch: Unified World-Action Modeling with PatchWAM

    Sep 22, 2026Tianheng Wang, Zhou Xie, Heng Jia +3Action GenerationVisuomotor Control

  4. RoboMP-DINOv2: Prompts, Not Filters for Robust Robot Manipulation

    Sep 22, 2026Han Qi, Heng YangVisuomotor ControlRobot Systems

  5. MaskHarness-WAM: Instance-Grounded Harnessing for Long-Horizon Robot Manipulation

    Sep 17, 2026Zitai Huang, Taiyi Su, Jian Zhu +6Long-Horizon ManipulationVisuomotor Control

  6. Rethinking Visual Embodiment Dependence in Visuomotor Policies

    Sep 15, 2026Hongjie Fang, Yuxuan Lu, Chenxi Wang +8Visuomotor ControlEmbodiment

  7. ViBe: Visual Behavior Adaptation for Perceptive Humanoid Whole-Body Control

    Sep 9, 2026Lokesh Krishna, Sarvesh Venkatesan, An Zhang +1Whole-Body ControlVisuomotor Control

  8. TaskSense: Focusing on What Matters in World Models

    Aug 6, 2026SM Mazharul Islam, Manfred HuberLatent World ModelsVisuomotor Control

  9. SkillMemo: Expert-guided Skill Memory Framework for Compositional Embodied Manipulation

    Aug 6, 2026Changyuan Wang, Chubin Zhang, Zhenyu Wu +8Visuomotor ControlReal-World Manipulation Tasks

  10. Unified Visuomotor Targets: Supervising VLAs Beyond Physical Actions

    Aug 4, 2026Zhenyang Feng, Unnat JainVisuomotor ControlLatent Prediction

  11. Disentangling Visuo-Tactile Foresight: Oracle-Guided Interface Discovery for World Action Models

    Aug 1, 2026Zihang Yao, Chaoyue Ding, Yingying YuTactile World ModelTactile

  12. Evolving Cache Schedules for Fast Diffusion Policy Inference

    Jul 22, 2026Siying Wang, Kangye Ji, Di Wang +1Diffusion PoliciesIterative Denoising Methods

  13. DiMaS: Distribution Matching for Steering Vision-Language-Action Models

    Jul 15, 2026Pegah Khayatan, Sara Meziane, Jayneel Parekh +1Flow-Matching Vision-Language-ActionVisuomotor Control

  14. Harness VLA: Steering Frozen VLAs into Reliable Manipulation Primitives via Memory-Guided Agents

    Jul 9, 2026Yixian Zhang, Huanming Zhang, Feng Gao +14Goal-Conditioned Dynamic ManipulationVisuomotor Control

  15. TFP: Temporally Conditioned Memory-Fusion Policies for Visuomotor Learning

    Jul 9, 2026Yushen Liang, Yue Peng, Baosheng Jin +6Generalizable Vision-Language-Action PoliciesVisuomotor Control

  16. PriGo: Test-Time Primitive Guidance to Diffusion and Flow Policies for Adaptive Robotic Manipulation

    Jul 8, 2026Zezeng Li, Enda Xiang, Thuy Tran +3Robotic ManipulationImitation Learning

  17. RoboTALES: Learning Reasoning-Guided Robot Policies via Task-Aligned Simulated Futures

    Jul 7, 2026Hanan Gani, Tejal Kulkarni, Madhoolika Chodavarapu +2Robot PoliciesVisuomotor Control

  18. High-Fidelity One-Step Generative Visuomotor Policy via Recursive Correction, Frequency Consistency, and Contrastive Flow Matching

    Jul 4, 2026Yuran Chen, Xinye Cai, Zhonglin Gong +1Visuomotor PolicyVisuomotor Control

  19. Efficient Sim-to-Real Transfer of World-Action Models from Synthetic Priors

    Jun 30, 2026Zixing Wang, Kausik Sivakumar, Jinghuan Shang +5Sim-To-Real Reinforcement LearningRobotic Manipulation

  20. BiliVLA: Scene-Aware Vision-Language-Action Model with Reinforcement Learning for Autonomous Biliary Endoscopic Navigation

    Jun 22, 2026Jinsong Lin, Chi Kit Ng, Zhiyong Xiong +8Robotic Soft EsophagusColonoscopy

  21. PanoVine: Whole-Body Visuomotor Control for Soft Growing Vine Robot

    Jun 22, 2026Yimeng Qin, Xiaomeng Xu, William Heap +3Mobile RobotsRobot State

  22. Predictive Gaze Is Preserved but Reorganized toward Monitoring during Robot-Mediated Manipulation

    Jun 20, 2026Manuela Uliano, Silvia Fattorini, Marco ControzziGaze BehaviorVisuomotor Control

  23. MirrorDuo: Reflection-Consistent Visuomotor Learning from Mirrored Demonstration Pairs

    Jun 18, 2026Zheyu Zhuang, Ruiyu Wang, Giovanni Luca Marchetti +2Behavior CloningVisuomotor Control

  24. ART-VS: Adaptive Resolution Tiling for Vision Transformer Visual Servoing

    Jun 17, 2026Alessandro Scherl, Bernhard Neuberger, Simon Schwaiger +3Visual ServoingSelf-Supervised Vision Transformers

  25. Contrastive Action-Image Pre-training for Visuomotor Control

    Jun 15, 2026Yuvan Sharma, Dantong Niu, Anirudh Pai +16Visuomotor ControlDiffusion-Based Vision-Language-Actions

  26. CT-VAM: A Cerebello-Thalamic-Inspired Vision-Action Model for Efficient Visuomotor Control

    Jun 8, 2026Jiacheng Li, Yize Guo, Jiabin Guo +2Diffusion-Based Vision-Language-ActionsVisuomotor Control

  27. From Abstraction to Instantiation: Learning Behavioral Representation for Vision-Language-Action Model

    May 21, 2026Bing Hu, Zaijing Li, Rui Shao +4Diffusion-Based Vision-Language-ActionsLatent Actions

  28. UAM: A Dual-Stream Perspective on Forgetting in VLA Training

    May 15, 2026Jianke Zhang, Yuanfei Luo, Yucheng Hu +6Visuomotor ControlIterative Co-Training

  29. Hyper-DP3: Frequency-Aware Right-Sizing of 3D Diffusion Policies for Visuomotor Control

    May 2, 2026Jinhao Zhang, Zhexuan Zhou, Huizhe Li +5Diffusion PoliciesVisuomotor Policy

  30. VISION-SLS: Safe Perception-Based Control from Learned Visual Representations via System Level Synthesis

    Apr 27, 2026Antoine P. Leeman, Shuyu Zhan, Melanie N. Zeilinger +1Visual ServoingVisuomotor Control

  31. Agent-Centric Observation Adaptation for Robust Visual Control under Dynamic Perturbations

    Apr 27, 2026Zhengru Fang, Yu Guo, Fei Liu +5Photometric SupervisionImage Restoration

  32. SlotVLA: Towards Modeling of Object-Relation Representations in Robotic Manipulation

    Nov 10, 2025Taisei Hanyu, Nhat Chung, Huy Le +10Robotic ManipulationVisuomotor Control

  33. Ask-to-Clarify: Resolving Instruction Ambiguity through Multi-turn Dialogue

    Sep 18, 2025Xingyao Lin, Xinghao Zhu, Tianyi Lu +6Embodied AgentsVisuomotor Control