Robustness of VLA Models

VLA: Vision-Language-Action

Latest papers 138

All topics
CardsList
  1. Uncovering and Mitigating Positional Blind Spots in Vision-Language-Action Models

    Aug 3, 2026Dongdong An, Pengjie Zhao, Yihao Huang +5Vision-Language-Action ModelsVLMs for Robotics

  2. OC-VLA++: Monocular Geometry-Guided Cross-View Consistency for Viewpoint-Robust Robotic Manipulation

    Aug 2, 2026Tianyi Zhang, Ziyang Gong, Zhenjie Yang +2Multi-View ConsistencyGeneralization in Robotic Manipulation

  3. VLAGuard: A Framework for Evaluating and Mitigating Physical Attention Hijacking in Vision-Language-Action Robots within Wireless Sensor Networks

    Aug 2, 2026Dongfu Yin, Jinquan ZhangAdversarial Patch AttacksAdversarial Attacks on VLA Models

  4. ActFovea: Runtime Safeguarding for VLA Policies via Spatiotemporal Visual-Action Consistency

    Jul 31, 2026Wenda Yu, Tianshi Wang, Fengling Li +3Robot SafetyRobotic Manipulation

  5. ST-WAM: Semantic-Temporal World Action Model for Robust Manipulation under Visual Distribution Shifts

    Jul 31, 2026Mingxin Wang, Bin Hu, Bin Qian +12World Models for RoboticsGeneralization in Robotic Manipulation

  6. RoboBRIDGE: A Modular Framework for Bridging Policies to Robust Real-World Robotic Agents

    Jul 30, 2026Sihyung Yoon, Minjong Yoo, Sanghyun Ahn +2Long-Horizon Robotic ManipulationRobotics

  7. RL2^2-VLA: Adaptive RL Latent Compositional Steering with Test-Time Scaling for Vision-Language-Action Models

    Jul 29, 2026Derek Ming Siang Tan, Shailesh Shailesh, Srikrishna Iyer +4Vision-Language-Action ModelsTest-Time Adaptation of VLA Models

  8. FutureRTC: Real-Time Robot Execution with Anticipatory-Conditioned Action Chunking

    Jul 27, 2026Hai Jiang, Yixian Zou, Binbin Liang +3Vision-Language-Action ModelsAction Chunking

  9. MulRobBench: A Decision-Level Benchmark for Safe and Security-Policy-Compliant Multimodal UAV Agents

    Jul 26, 2026Belal S. Alsinglawi, Weizheng Wang, Junyi Wu +3Aerial RoboticsAI Agent Security Benchmarks

  10. STeP: Signal Temporal Logic for Precise Specifications for Action Generation with Vision Language Models

    Jul 20, 2026Kasra Torshizi, Anukriti Singh, Sidharth Mathur +3Language-Conditioned Robot ControlVLMs for Robotics

  11. AC-VLA: Robust Out-of-Distribution Action Execution via Compositional Learning

    Jul 17, 2026Xiaojiang Peng, Kai Peng, Jie Lu +3Robot Skill LearningGeneralization in Robotic Manipulation

  12. CosFly-VLA: A Spatially Aware Vision-Language-Action Model for UAV Tracking

    Jul 16, 2026Ruilong Ren, Songsheng Cheng, Yunpeng Zhou +9Aerial RoboticsVisual Object Tracking

  13. Learning Robust Execution in Robotic Manipulation with Agentic Reinforcement Learning

    Jul 15, 2026Xiaopeng Zhang, Yueyang Weng, Qi Liu +2Agentic RLRobot Failure Recovery

  14. Semantic Anchoring for Robotic Action Representations

    Jul 15, 2026Yuan Xu, Youheng Shi, Chengyang Li +2Generalization in Robotic ManipulationVision-Language-Action Models

  15. Generalizable VLA Finetuning via Representation Anchoring and Language-Action Alignment

    Jul 15, 2026Dwip Dalal, Shivansh Patel, Chahit Jain +8Vision-Language-Action ModelsVision-Language Alignment

  16. ChunkFlow: Towards Continuity-Consistent Chunked Policy Learning

    Jul 14, 2026Zhao Yang, Yinan Shi, Mingyuan Yao +3Visuomotor Policy LearningVision-Language-Action Models

  17. TrustVLA: Mechanism-Guided Inference-Time Defense Against Vision-Language-Action Backdoors

    Jul 14, 2026Pinhan Fu, Xianda Guo, Xuetao Li +5Adversarial Attacks on VLA ModelsVision-Language-Action Models

  18. Artificial Foveated Perception for Mitigating Shortcut Learning in Robotic Foundation Models

    Jul 12, 2026Xiatao Sun, Yuan Zhuang, Mateo Sanchez Lopez Negrete +9Robot Foundation ModelsVisual Grounding

  19. SUREFlow: State-space Uncertainty-aware REsidual Flow Matching for Robust Robot Manipulation

    Jul 11, 2026Md Tanvir Islam, Sai Navaneet Peddapalli, Sangmoon Lee +1Flow MatchingUncertainty Estimation for VLA Models

  20. CLAP: Direct VLM-to-VLA Adaptation via Language-Action Grounding

    Jul 9, 2026Yuri Ishitoya, Jeremy Siburian, Masashi Hamaya +3VLM AdaptationRobotic Manipulation

  21. Harness VLA: Steering Frozen VLAs into Reliable Manipulation Primitives via Memory-Guided Agents

    Jul 9, 2026Yixian Zhang, Huanming Zhang, Feng Gao +14Long-Horizon Robotic ManipulationLanguage-Conditioned Robot Manipulation

  22. From Fixed to Free Cameras: Calibration-Free View-Robust Vision-Language-Action Model

    Jul 6, 2026Wenhao Li, Xueying Jiang, Quanhao Qian +4Language-Conditioned Robot ManipulationHand-Eye Calibration

  23. !Imperio, smolVLA: The Implications of Data Poisoning on Open Source Robotics

    Jul 5, 2026Stefan Bühler, Mark SchuteraNeural Network RobustnessAdversarial Attacks on VLA Models

  24. CoRE-VLA: Towards Scalable and Robust Vision-Language-Action Modeling via Conditional Routing of Experts

    Jul 4, 2026Haozhe Zhang, Sixian Li, Yifei Zhang +5Multimodal RobustnessLanguage-Conditioned Robot Manipulation