VLM Robustness

VLM: Vision-Language Model

Latest papers 295

All topics
CardsList
  1. Consistent Yet Wrong: Evidence Insensitivity in Spatial Vision-Language Models

    Jun 1, 2026S Divakar Bhat, Toshihiko YamasakiVLM EvaluationMulti-View Consistency

  2. Mechanistic Diagnostics of Spatial Lexical Bias in Multimodal Large Language Model Spatial Reasoning

    Jun 1, 2026Chuang Ma, Qianying Liu, Tomoyuki Obuchi +6VLM RobustnessVisual Spatial Reasoning

  3. Density-Aware Translation of Spurious Correlations in Zero-Shot VLMs

    Jun 1, 2026Afsaneh Hasanebrahimi, Hanxun Huang, Christopher Leckie +1VLM RobustnessVision-Language Models

  4. Make Your VLA More Robust Without More Data By Interleaving Motion Planning

    May 31, 2026Dan BW Choe, Sundhar Vinodh Sangeetha, Samuel Coogan +1VLM RobustnessLong-Horizon Robotic Manipulation

  5. RoboStressBench: Benchmarking VLM Robustness to Physical Visual Stress in Embodied Scenes

    May 30, 2026Leyi Wu, Yifan Zhao, Jinjie Zhang +11VLM EvaluationVLM Robustness

  6. The Regularizing Power of Language-Training Deepfake Detectors

    May 29, 2026Benedikt Hopf, Zongwei Wu, Radu TimofteVLM RobustnessExplainable Deepfake Detection

  7. What Makes LVLMs Hallucinate Less? Unveiling the Architectural Factors Behind Hallucination Robustness

    May 29, 2026Yusheng He, Jizhe Zhou, Xia Du +3VLM EvaluationVLM Robustness

  8. Immuno-VLM: Immunizing Large Vision-Language Models via Generative Semantic Antibodies for Open-World Trustworthiness

    May 29, 2026Xiang Fang, Wanlong Fang, Wei JiVLM RobustnessLarge Vision-Language Models

  9. LoMo: Local Modality Substitution for Deeper Vision-Language Fusion

    May 28, 2026Feng Han, Zhixiong Zhang, Zheming Liang +2Cross-Modal LearningVLM Robustness

  10. MuPHI: Learning Implicit Multimodal Harm Reasoning via Semantically Grounded Reward Optimization

    May 28, 2026Anisha Saha, Varsha Suresh, Teodora Kamova +3VLM RobustnessMultimodal Reasoning

  11. TRACER: Persistent Regularization for Robust Multimodal Finetuning

    May 28, 2026Hesam Asadollahzadeh, Feng Liu, Christopher Leckie +1VLM RobustnessNeural Network Robustness

  12. When Think-with-Image Meets Safety: What Determines Multimodal Jailbreak Robustness?

    May 27, 2026Yuan Tian, Bing Hu, Fang Wu +3VLM RobustnessTool Use in VLMs

  13. Structure-Guided Visual Perturbation Neutralization for LVLMs

    May 27, 2026Yuanhe Zhang, Xueting Wang, YanBin Ren +6VLM RobustnessAdversarial Attacks on VLMs

  14. Towards Unified Vision-Language Models with Incomplete Multi-Modal Inputs

    May 27, 2026Xiang Fang, Wanlong Fang, Changshuo Wang +4Missing-Modality LearningVLM Robustness

  15. On the Robustness of Machine Unlearning for Vision-Language Models

    May 26, 2026Yujie Lin, Kaidi Jia, Jiayao Ma +2VLM EvaluationVLM Unlearning

  16. Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization

    May 26, 2026Xiang Fang, Wanlong Fang, Changshuo WangVLM RobustnessAdversarial Attacks on VLMs

  17. Closed-Loop Bidirectional Prompting for Adversarial Robustness of Vision Language Models

    May 25, 2026Xiao Liu, Jiaxiang Liu, Boci Peng +6VLM RobustnessPrompt Learning

  18. Localization then Neutralization: Gradient-guided Token Suppression against Visual Prompt Injection Attack

    May 24, 2026Dongpeng Zhang, Ke Ma, Yangbangyan Jiang +4Gradient-Based AttributionVLM Robustness

  19. Mitigating Object Hallucinations in Vision-Language Models through Region-Aware Attention Recalibration

    May 24, 2026Yuanzhi Xu, Qian Gao, Jun Fan +4VLM RobustnessVision-Language Models

  20. DUEL: Adversarial Self-Play for Multimodal Reasoning

    May 24, 2026Lin Qiu, Hanqing Zeng, Yao Liu +3VLM RobustnessVLM Reasoning

  21. SpaceDG: Benchmarking Spatial Intelligence under Visual Degradation

    May 21, 2026Xiaolong Zhou, Yifei Liu, Ziyang Gong +8VLM RobustnessSpatial Reasoning Benchmarks

  22. Lost in Fog: Sensor Perturbations Expose Reasoning Fragility in Driving VLAs

    May 20, 2026Abhinaw Priyadershi, Jelena FrtunikjVLM RobustnessVLMs for Autonomous Driving

  23. Mitigating Hallucinations in Large Vision-Language Models via Causal Route Gating

    May 20, 2026Zhe Cheng, Wenyu Chen, Fode Zhang +1VLM RobustnessHallucination in Language Models

  24. The Yes-Man Syndrome: Benchmarking Abstention in Embodied Robotic Agents

    May 19, 2026Doguhan Yeke, Elif Su Temirel, Ananth Shreekumar +3VLM RobustnessLarge Language Model-Based Robot Planning

  25. Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models

    May 19, 2026Jia-Wei Hai, Yijun Wang, Xiu-Shen WeiVLM RobustnessAdversarial Attacks on VLMs

  26. Structured Layout Priors for Robust Out-of-Distribution Visual Document Understanding

    May 19, 2026Peter El Hachem, Ahmed Nassar, A. Said Gurbuz +2VLM RobustnessLLM Prompting