Robustness of VLA Models

VLA: Vision-Language-Action

Latest papers 138

All topics
CardsList
  1. Do Vision-Language-Action Models Understand Instructions? A Mechanistic Interpretability Study on Language Grounding

    Oct 7, 2026Theodor Wulff, Angelo CangelosiVision-Language-Action ModelsRobustness of VLA Models

  2. TMT: Runtime Backdoor Detection for Vision-Language-Action Policies on Unseen Tasks

    Oct 7, 2026Zirun Zhou, Jingfeng Zhang, HaoChuan Xu +4Backdoor DetectionRobustness of VLA Models

  3. OGAM: Connecting Systematic Testing to Runtime Assurance through Object-Grounded Attention Monitoring for VLA Policies

    Oct 5, 2026Haki Darwish, Xiangyu Yin, Changwen Li +3Instruction Generalization in VLA ModelsRobustness of VLA Models

  4. Beyond In-Distribution Preservation: Recovering Generalization in Quantized VLAs via Vulnerability-Oriented Tuning

    Oct 5, 2026Shen Ruan, Wenchang Gao, Jin Wang +4VLM QuantizationOOD Generalization

  5. Continuous Conditioning of VLAs with Augmenting EMG and Visual Task Descriptors

    Oct 1, 2026Edward W. Staley, Connor O. Pyles, Rahul Hingorani +5Robotic ControlVision-Language-Action Models

  6. Is Success All You Need? Investigating the Impact of Input Perturbations on VLA Behaviour in Tabletop Manipulation Tasks

    Oct 1, 2026Sophie Higham, Riccardo Andrea Izzo, Matteo Matteucci +1Vision-Language-Action ModelsRobot Manipulation Benchmarks

  7. Multi-Link Safety Filtering for VLA Policies Around Moving Hazards

    Sep 30, 2026Yatharth Agarwal, Vijay RaghunathanRobot SafetySafety Filtering

  8. When Instructions Retrieve Trajectories: Diagnosing and Mitigating Generalization Failures in VLA Models

    Sep 30, 2026Hung-Jen Chen, Yu-Hsun Hou, Yan-Hong Chen +4Robotic ManipulationVision-Language-Action Models

  9. Blackout vs. Freeze: Analyzing Physical Failure Modes of VLAs under Camera Faults

    Sep 30, 2026Heejae Suh, Jongwook Han, Zahra Gholami +1Robotic ControlVision-Language-Action Models

  10. Beyond Prediction: Steering VLM Agents with Retrospective World Modeling

    Sep 30, 2026Yongjiang Liu, Jie Zhang, Haoyue Zhang +3World Model LearningWorld Models

  11. Refusals That Bend: Measuring and Predicting Task Malleability in Embodied VLM Planners

    Sep 30, 2026Leo Y. Lin, Mikhail Kuznetsov, Muslum Ozgur Ozmen +1Robot SafetyLLM Safety Evaluation

  12. RawVLA: Embodied Neural Image Signal Processor For Robotic Manipulation

    Sep 29, 2026Shuhong Liu, Heng Zhou, Lingfeng Qian +7Robotic ManipulationVision-Language-Action Models

  13. Disentangling Spurious Correlations in Vision-Language-Action Models via Predicting Domain-Invariant Latent Lookahead

    Sep 29, 2026Junghyun Kim, Ngseo Kim, ChungWoo Lee +7Domain GeneralizationVision-Language-Action Models

  14. CoRe-VLA: Preserving Cross-View Coordination in VLAs under Camera Shifts

    Sep 29, 2026Tianhang Pan, Xuanhao Wang, Yiwen Pang +4Point Cloud Surface ReconstructionVision-Language-Action Models

  15. Where Predictive Supervision Goes Shapes What VLA Policies Learn

    Sep 29, 2026Hanseul Kim, Jewon Yeom, Youngjoon Jeong +2Visuomotor Policy LearningVision-Language-Action Models

  16. Learning to Act under Visual Interruptions with Vision-Language-Action Models

    Sep 28, 2026Mingle Jiang, Rui Xu, Yunke Wang +1Vision-Language-Action ModelsVision-Based Robot Control

  17. ActionUNet: Improving Robustness of VLA Models with Efficient Multi-scale Fine-tuning

    Sep 28, 2026Di Zhu, Ziheng Yan, Fang WanRobotic ControlEfficient VLA Models

  18. RoboIRGBench: Benchmarking Implicit Referential Grounding in Vision-Language-Action Models

    Sep 28, 2026Aernaer Akelijiang, Jiannan Li, Zhineng Chen +2Language-Conditioned Robot ManipulationVision-Language-Action Models

  19. TLC-DiT: Task-Aligned Local Visual Conditioning for Robust Multitask Robot Manipulation

    Sep 28, 2026Xianbo Cai, Hideyuki Ichiwara, Zihang Wang +2Language-Conditioned Robot ManipulationMulti-Task Robotic Manipulation

  20. Does Adversarial Training Improve Generalization in Multi-View VLAs? Revealing and Mitigating View Collapse

    Sep 27, 2026Futa Waseda, Shuhei Kurita, Isao EchizenAdversarial TrainingMulti-View Learning

  21. FRAM: Trajectory-Guided Visual Feature Selection for Compact Language-Conditioned Robot Manipulation

    Sep 25, 2026Hiroshi Ito, Hyogo Hiruma, Yoshiki Kanai +3Language-Conditioned Robot ManipulationEfficient VLA Models

  22. Self-Adaptive VLA for Robust Robot Deployment

    Sep 24, 2026Hongxin Zhang, Chunru Lin, Tsun-Hsuan Wang +2Robot Policy LearningRobot Policy Adaptation

  23. IndustrialVLA-Bench: A Traceable Multi-Axis Evaluation of Open Robot Policy Models

    Sep 22, 2026Yiqi Wang, Zhifeng Rao, Jiaqi Zhang +7Robotic Policy EvaluationVision-Language-Action Models

  24. LIBERO-VPro: Benchmarking Closed-Loop Visual Robustness of Robotic Foundation Models

    Sep 21, 2026Huiqiong Li, Zhiting Mei, Anirudha Majumdar +3World Models for RoboticsRobot Foundation Models

  25. CARE: Experience-Guided Atomic Corrective Execution for Vision-Language-Action Policies

    Sep 21, 2026Junlan Xiao, Junwei Jiang, Zaibin Zhang +4Long-Horizon Robotic ManipulationVision-Language-Action Models

  26. Beyond Appearance Shifts: Task-Semantic Action Calibration for VLA Models

    Sep 20, 2026Shuaijun Liu, Feiyang You, Chengyu Wu +5Vision-Language-Action ModelsVLMs for Robotics

  27. MaskVLA: Visual Masking Against Trajectory Overfitting of Vision-Language-Action Model

    Sep 20, 2026Yuxuan Jiang, Jiaying Huang, Ge Wang +9Robotic ManipulationVision-Language-Action Models

  28. An Empirical Study and Open Testbed for Federated Fine-Tuning of Vision-Language-Action Models

    Sep 19, 2026Zhekai Duan, Kevin Ziyang Xie, Xinyu Tan +5Vision-Language-Action ModelsVLMs for Robotics

  29. Beyond Patch Removal: Persistent Adversarial Effects in Vision-Language-Action Policies

    Sep 17, 2026Enhao Wu, Fusen Guo, Yuxin Cao +3Adversarial Patch AttacksAdversarial Attacks on VLA Models

  30. SAVLA: Symmetry-Aware Vision-Language-Action Models for Robotic Manipulation

    Sep 15, 2026Junle Li, Weixian Waylon Li, Fuxiang Wu +2Language-Conditioned Robot ManipulationVision-Language-Action Models

  31. Atomic Motion Coordinate for Language-Steerable and Force-Responsive Manipulation

    Sep 14, 2026Jiaqi Zhai, Jingkai Zhao, Chen Yang +10Language-Conditioned Robot ManipulationForce-Controlled Robotic Manipulation

  32. Breaking the Vision-Action Shortcut: Latent Interface Training for Generalizable Robotics Foundation Models

    Sep 14, 2026Jianman Lin, Shailesh Shailesh, Zhongyi Luo +1Robot Foundation ModelsVision-Language-Action Models

  33. HuRo: Robotizing Human Videos for Scalable VLA Pretraining

    Sep 9, 2026Jinho Jeong, Se June Joo, Jaehyun Kang +4Cross-Embodiment Robot LearningVision-Language-Action Models

  34. Where Success Breaks: Failure-Boundary Learning for Robust Vision-Language-Action Models

    Sep 5, 2026Yanzhe Chen, Zhijun Cao, Mike Zheng ShouVision-Language-Action ModelsRobustness of VLA Models

  35. LIBERO-RECOVER: Beyond Task Success Towards Failure Recovery in Robotic Manipulation Models

    Sep 4, 2026Lin Liu, Zhicheng Bao, Lu Zhang +7Robot Failure RecoveryRobotic Manipulation

  36. WISE: World-model-guided Imagination Scheduling for Efficient Post-training of Vision-Language-Action Models

    Sep 3, 2026Chenhao Zhang, Hanyu Zhao, Hang Cheng +2Robot Skill LearningWorld Models for Robotics

  37. Sensing Which Modality Matters: Evidence-Gated Regularization for Robust VLA Policies

    Sep 2, 2026Yue Yang, Diego Romeres, Chiori Hori +3Robustness of VLA ModelsMultimodal Sensor Fusion

  38. Training-Free Action Correction for VLA Model Failures via Language Feedback

    Aug 30, 2026Owen Kwon, Pablo Ortega-Kral, Arthur Bucker +1Vision-Language-Action ModelsTest-Time Adaptation of VLA Models

  39. Policy-Induced Hand Priors in Humanoid Dual-Arm Manipulation: Diagnosing and Mitigating Initial-Pose Dependence

    Aug 12, 2026Chaeyeon Jung, Juyoun ParkBimanual Robotic ManipulationRobotic Manipulation

  40. Trajectory Divergence Horizon Decision for Reliable Dual-Arm Surgical Subtask Manipulation

    Aug 10, 2026Mingwu Su, Guankun Wang, Jinsong Lin +8Robotic ControlBimanual Robotic Manipulation

  41. Cross-View Action Consistency for Camera-Robust Vision-Language-Action Policies

    Aug 7, 2026Bingqi Huang, Bingchuan Wei, Xuan Wang +2Multi-View ConsistencyVision-Based Robot Control

  42. CofactVLA: Deconfounding Vision-Language-Action Models via Counterfactual Intervention

    Aug 5, 2026Yan Zhang, Yinan Wu, Haoran Duan +1Robotic ManipulationVision-Language-Action Models

  43. SAFECAST: Robust Failure Detection for VLA Policies with Contrast-Set Training and Calibration

    Aug 4, 2026Harshitha Rajaprakash, Aditeya Prajapati, Rong Xue +2Vision-Language-Action ModelsRobustness of VLA Models

  44. Unified Visuomotor Targets: Supervising VLAs Beyond Physical Actions

    Aug 4, 2026Zhenyang Feng, Unnat JainLatent Action LearningVisuomotor Policy Learning

  45. Structure-Aware Robust Fine-Tuning: Defending Vision-Language-Action Robots Against Physical Attention Hijacking

    Aug 4, 2026Jinquan Zhang, Dongfu Yin, Run Yang +3Fine-TuningLanguage-Conditioned Robot Manipulation

  46. Grounded Semantic Re-Binding for Robust Instruction Generalization in Vision-Language-Action Models

    Aug 3, 2026Zhaokai Yin, Zhipeng ZhangVision-Language GroundingVision-Language-Action Models