VLM Robustness

VLM: Vision-Language Model

Latest papers 295

All topics
CardsList
  1. Detecting Adversarial Images through Response Profiles of Vision-Language Models

    Oct 7, 2026Arash Vashagh, Roozbeh Razavi-FarAdversarial Example DetectionVLM Robustness

  2. Purifying Backdoored Large Vision-Language Models by Removing Hijacked Directions

    Oct 7, 2026Bojun Yang, Haochen Zhou, Zhifang Zhang +3VLM RobustnessLarge Vision-Language Models

  3. Understanding and Mitigating Token-Pruning-Induced Vulnerabilities in VLMs

    Oct 7, 2026Shuailong Wang, Xinyu Lyu, Shengming Yuan +3Visual Token PruningVLM Robustness

  4. Anti-Persona: Disrupting Unauthorized Identity Binding and Recognition in Personalized Vision--Language Models

    Oct 1, 2026Abhishek Basu, Fahad Shamshad, Karthik NandakumarVLM RobustnessVision-Language Models

  5. Do MLLM Judges Judge the Edit? Auditing Bias in Image Editing Evaluation with Verified Quality Preservation

    Oct 1, 2026Yuan Huang, Zirui Song, Xiuying ChenVLM RobustnessLLM-as-a-Judge

  6. Towards Reliable Vision-Language Models for Autonomous Driving

    Oct 1, 2026Manasa Mariam Mammen, Priyanka Mary Mammen, Zafer Kayatas +1VLM RobustnessImage Corruption Robustness

  7. When Masking Helps or Hurts Robustness in Compressed CLIP: A Pre-Deployment Diagnostic

    Sep 30, 2026Muhammad Zawish, Steven DavyVLM RobustnessEfficient VLM Inference

  8. Typographic Attack Against VLM-based AI-generated Image Detection

    Sep 30, 2026Eunmin Lee, Jungwoo Kim, Jong-Seok LeeVLM EvaluationVLM Robustness

  9. Feature-Aware Token Attack for Compression-Triggered Stealthy Failures in Large Vision-Language Models

    Sep 30, 2026Shilinlu Yan, Bowen Chen, Yuechen Zhang +3VLM RobustnessAdversarial Attacks on VLMs

  10. SceneJail: Exploiting Video Scenario Context to Jailbreak Multimodal LLMs

    Sep 30, 2026Wenyu Chen, Li Wang, Chuanchao Zang +5VLM RobustnessJailbreak Attacks

  11. Uncovering Uncontrolled Repetition through Residual Stream Dynamics

    Sep 30, 2026Yuanhe Zhang, Xinyao Zhou, Haoran Gao +5VLM Robustness

  12. It's Not What the Image Shows: Irrelevant Context Destabilises VLM Judges Without Informing Them

    Sep 29, 2026Nagham Omar, Mahmoud Jabarin, Kinan Ibraheem +1VLM EvaluationFigurative Language Understanding

  13. Can Vision-Language Models Stay Helpful When Facing Implicit Risks? Intent-Privilege OPSD for Efficient Safety-Helpfulness Alignment

    Sep 29, 2026Haotian Deng, Wenbin Xing, Gang Xu +5VLM RobustnessVision-Language Models

  14. Selective Channel Restoration for Backdoored Vision-Language Models

    Sep 29, 2026Shuming Liu, Zhifang Zhang, Suqin Yuan +3VLM RobustnessLarge Vision-Language Models

  15. DSPO: Diversity-aware Subjective Policy Optimization for Robust Emotional Reasoning

    Sep 29, 2026Cheng Ye, Weidong Chen, Bingyan Xu +1VLM RobustnessMultimodal Reasoning

  16. Still There, No Longer Seen: Exposing Compression-Induced Risk in Large Vision-Language Models

    Sep 28, 2026Qiankun Li, Yuechen Zhang, Bowen Chen +4VLM RobustnessAdversarial Attacks on VLMs

  17. Backdoor as Probe: Test-Time Adversarial Defense for CLIP

    Sep 28, 2026Zhongqi Wang, Jie Zhang, Nie Sen +3VLM RobustnessBackdoor Defense

  18. MoGround: Measuring and Mitigating Modality Distraction in Vision-Language Models

    Sep 27, 2026Luca Zhou, Bo Zhao, Rose Yu +2VLM EvaluationMultimodal Grounding

  19. Looks the Same, Answers Differently: Flip-Direction Steering for Robust Vision-Language Reasoning

    Sep 23, 2026Yeonsung Jung, Joonhyun Jeong, Hoang Pham +4VLM RobustnessCounterfactual Evaluation of VLMs

  20. Cross-Modal Attention Acts as a Frequency Filter: Why Verbose Prompts Improve Robustness in Vision-Language Models

    Sep 17, 2026Farooq Ahmad Wani, Maria Sofia Bucarelli, Mujtaba Hussain Mirza +5VLM RobustnessPrompt Sensitivity

  21. Decodable but Misrouted: Sparse Features Uncover a Readout Gap in Vision-Language Models for Harmful Meme Detection

    Sep 16, 2026Girish A. Koushik, Diptesh Kanojia, Helen TreharneVLM EvaluationVLM Robustness

  22. EDCT-Bench: Uncovering Faithfulness Gaps in VLMs via Explanation-Driven Counterfactual Testing

    Sep 16, 2026Sihao Ding, Santosh Vasa, Aditi Ramadwar +1VLM EvaluationVLM Robustness

  23. Beyond Accuracy: Robustness, Cost, and Governance Trade-offs for Vision-Language Models in Templated Document Extraction

    Sep 14, 2026Kushal Patel, Pushkal Shrivastava, Mackenzie Lees +4VLM EvaluationVLM Robustness

  24. Can Edge-Deployable Vision-Language Models Identify Species?

    Sep 12, 2026William Zhou, Mayukha Siripuram, Xiao Yan +2VLM EvaluationVLM Robustness

  25. Isotropic Embedding Perturbations for Robust Vision Language Encoders

    Sep 9, 2026Hyesong Choi, Daeun Kim, Song Park +5VLM RobustnessData Augmentation

  26. Do Input-Level Defenses Transfer to Observation-Level Attacks on VideoLLMs?

    Sep 8, 2026Bangshuo Zhu, Wei Song, Yuxin Cao +4VLM RobustnessAdversarial Attacks on VLMs

  27. CS-CLIP: Compositional Scene Graph-guided CLIP for Robust Compositional Reasoning

    Sep 8, 2026SeongJun Jeong, Minjoon Jung, Woo Suk Choi +2VLM RobustnessContrastive Learning