Safety Evaluation of VLA Models

VLA: Vision-Language-Action

Latest papers 15

All topics
CardsList
  1. ReVeal: A Reconstruction-Aware Real-to-Sim Framework for VLA Policy Evaluation

    Sep 20, 2026Xinyi Wang, Heng Hao, Wenjun Hu +53D ReconstructionRobotic Manipulation

  2. MAE I Trust Myself? Self-Evaluating VLA Action Generation with Markov Attention Entropy

    Aug 17, 2026Aniri, Chen Yilin, Jinhe Bi +7Uncertainty Estimation for VLA ModelsLLM Uncertainty Estimation

  3. ForesightSafety-VLA: A Unified Diagnostic Safety Benchmark for Vision-Language-Action Models

    Jun 25, 2026Mingyang Lyu, Yinqian Sun, Yiyang Jia +5RoboticsRobot Safety

  4. LIBERO-Safety: A Comprehensive Benchmark for Physical and Semantic Safety in Vision-Language-Action Models

    Jun 22, 2026Rongxu Cui, Zongzheng Zhang, Jingrui Pang +11Robot SafetyVision-Language-Action Models

  5. SafeVLA-Bench: A Benchmark for the Success-Safety Gap in Vision-Language-Action Models

    May 30, 2026Jialiang Fan, Weizhe Xu, Zijun Wang +3Robot SafetyRobotic Manipulation

  6. ReasonBreak: Probing Vulnerabilities in Reasoning-Enabled Vision-Language-Action Models for Autonomous Driving

    May 27, 2026Mohammadreza Teymoorianfard, Jean-Philippe Monteuuis, Jonathan Petit +1VLMs for Autonomous DrivingAutonomous Driving Safety Evaluation

  7. Pre-VLA: Preemptive Runtime Verification for Reliable Vision-Language-Action and World-Model Rollouts

    May 21, 2026Zhen Sun, Yongjian Guo, Haoran Sun +6Vision-Language-Action ModelsVLMs for Robotics

  8. Vision-Language-Action Safety: Threats, Challenges, Evaluations, and Mechanisms

    Apr 26, 2026Qi Li, Bo Yin, Weiqi Huang +6AI Agent SafetyAdversarial Attacks on VLA Models

  9. RedVLA: Physical Red Teaming for Vision-Language-Action Models

    Apr 24, 2026Yuhao Zhang, Borong Zhang, Jiaming Fan +4RoboticsAdversarial Attacks on VLA Models

  10. How VLAs (Really) Work In Open-World Environments

    Apr 23, 2026Amir Rasouli, Yangzheng Wu, Zhiyuan Li +4VLM RobustnessLong-Horizon Robotic Manipulation

  11. SafetyALFRED: Evaluating Safety-Conscious Planning of Multimodal Large Language Models

    Apr 21, 2026Josue Torres-Fonseca, Naihao Deng, Yinpei Dai +5LLM Safety BenchmarksLarge Language Model-Based Robot Planning

  12. HazardArena: Evaluating Semantic Safety in Vision-Language-Action Models

    Apr 14, 2026Zixing Chen, Yifeng Gao, Li Wang +8RoboticsAI Safety Evaluation