VLM Robustness

VLM: Vision-Language Model

Latest papers 295

All topics
CardsList
  1. Mechanistic Diagnostics of Spatial Lexical Bias in Multimodal Large Language Model Spatial Reasoning

    Jun 1, 2026Chuang Ma, Qianying Liu, Tomoyuki Obuchi +6VLM RobustnessVisual Spatial Reasoning

  2. Density-Aware Translation of Spurious Correlations in Zero-Shot VLMs

    Jun 1, 2026Afsaneh Hasanebrahimi, Hanxun Huang, Christopher Leckie +1VLM RobustnessVision-Language Models

  3. Make Your VLA More Robust Without More Data By Interleaving Motion Planning

    May 31, 2026Dan BW Choe, Sundhar Vinodh Sangeetha, Samuel Coogan +1VLM RobustnessLong-Horizon Robotic Manipulation

  4. RoboStressBench: Benchmarking VLM Robustness to Physical Visual Stress in Embodied Scenes

    May 30, 2026Leyi Wu, Yifan Zhao, Jinjie Zhang +11VLM EvaluationVLM Robustness

  5. The Regularizing Power of Language-Training Deepfake Detectors

    May 29, 2026Benedikt Hopf, Zongwei Wu, Radu TimofteVLM RobustnessExplainable Deepfake Detection

  6. What Makes LVLMs Hallucinate Less? Unveiling the Architectural Factors Behind Hallucination Robustness

    May 29, 2026Yusheng He, Jizhe Zhou, Xia Du +3VLM EvaluationVLM Robustness

  7. Immuno-VLM: Immunizing Large Vision-Language Models via Generative Semantic Antibodies for Open-World Trustworthiness

    May 29, 2026Xiang Fang, Wanlong Fang, Wei JiVLM RobustnessLarge Vision-Language Models

  8. LoMo: Local Modality Substitution for Deeper Vision-Language Fusion

    May 28, 2026Feng Han, Zhixiong Zhang, Zheming Liang +2Cross-Modal LearningVLM Robustness

  9. MuPHI: Learning Implicit Multimodal Harm Reasoning via Semantically Grounded Reward Optimization

    May 28, 2026Anisha Saha, Varsha Suresh, Teodora Kamova +3VLM RobustnessMultimodal Reasoning

  10. TRACER: Persistent Regularization for Robust Multimodal Finetuning

    May 28, 2026Hesam Asadollahzadeh, Feng Liu, Christopher Leckie +1VLM RobustnessNeural Network Robustness

  11. When Think-with-Image Meets Safety: What Determines Multimodal Jailbreak Robustness?

    May 27, 2026Yuan Tian, Bing Hu, Fang Wu +3VLM RobustnessTool Use in VLMs

  12. Structure-Guided Visual Perturbation Neutralization for LVLMs

    May 27, 2026Yuanhe Zhang, Xueting Wang, YanBin Ren +6VLM RobustnessAdversarial Attacks on VLMs

  13. Towards Unified Vision-Language Models with Incomplete Multi-Modal Inputs

    May 27, 2026Xiang Fang, Wanlong Fang, Changshuo Wang +4Missing-Modality LearningVLM Robustness

  14. On the Robustness of Machine Unlearning for Vision-Language Models

    May 26, 2026Yujie Lin, Kaidi Jia, Jiayao Ma +2VLM EvaluationVLM Unlearning

  15. Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization

    May 26, 2026Xiang Fang, Wanlong Fang, Changshuo WangVLM RobustnessAdversarial Attacks on VLMs

  16. Closed-Loop Bidirectional Prompting for Adversarial Robustness of Vision Language Models

    May 25, 2026Xiao Liu, Jiaxiang Liu, Boci Peng +6VLM RobustnessPrompt Learning

  17. Localization then Neutralization: Gradient-guided Token Suppression against Visual Prompt Injection Attack

    May 24, 2026Dongpeng Zhang, Ke Ma, Yangbangyan Jiang +4Gradient-Based AttributionVLM Robustness

  18. Mitigating Object Hallucinations in Vision-Language Models through Region-Aware Attention Recalibration

    May 24, 2026Yuanzhi Xu, Qian Gao, Jun Fan +4VLM RobustnessVision-Language Models

  19. DUEL: Adversarial Self-Play for Multimodal Reasoning

    May 24, 2026Lin Qiu, Hanqing Zeng, Yao Liu +3VLM RobustnessVLM Reasoning

  20. SpaceDG: Benchmarking Spatial Intelligence under Visual Degradation

    May 21, 2026Xiaolong Zhou, Yifei Liu, Ziyang Gong +8VLM RobustnessSpatial Reasoning Benchmarks

  21. Lost in Fog: Sensor Perturbations Expose Reasoning Fragility in Driving VLAs

    May 20, 2026Abhinaw Priyadershi, Jelena FrtunikjVLM RobustnessVLMs for Autonomous Driving

  22. Mitigating Hallucinations in Large Vision-Language Models via Causal Route Gating

    May 20, 2026Zhe Cheng, Wenyu Chen, Fode Zhang +1VLM RobustnessHallucination in Language Models

  23. The Yes-Man Syndrome: Benchmarking Abstention in Embodied Robotic Agents

    May 19, 2026Doguhan Yeke, Elif Su Temirel, Ananth Shreekumar +3VLM RobustnessLarge Language Model-Based Robot Planning

  24. Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models

    May 19, 2026Jia-Wei Hai, Yijun Wang, Xiu-Shen WeiVLM RobustnessAdversarial Attacks on VLMs

  25. Structured Layout Priors for Robust Out-of-Distribution Visual Document Understanding

    May 19, 2026Peter El Hachem, Ahmed Nassar, A. Said Gurbuz +2VLM RobustnessLLM Prompting

  26. RoVLA: Multi-Consistency Constraints for Robust Vision-Language-Action Models

    May 19, 2026Jingzhou Luo, Yifan Wen, Yongjie Bai +3VLM RobustnessLanguage-Conditioned Robot Manipulation