VLM Robustness

VLM: Vision-Language Model

Latest papers 295

All topics
CardsList
  1. Stress Tests REVEAL Fragile Temporal and Visual Grounding in Video-Language Models

    Feb 11, 2026Sethuraman T, Savya Khosla, Aditi Tiwari +12VLM RobustnessVideo-Language Model Evaluation

  2. VideoSTF: Stress-Testing Output Repetition in Video Large Language Models

    Feb 11, 2026Yuxin Cao, Wei Song, Shangzhi Xu +2VLM EvaluationVLM Robustness

  3. Robustness of Vision Language Models Against Split-Image Harmful Input Attacks

    Feb 8, 2026Md Rafi Ur Rashid, MD Sadik Hossain Shanto, Vishnu Asutosh Dasu +1VLM RobustnessAdversarial Attacks on VLMs

  4. Same Answer, Different Representations: Hidden instability in VLMs

    Feb 6, 2026Farooq Ahmad Wani, Alessandro Suglia, Rohit Saxena +6VLM EvaluationVLM Robustness

  5. CLIMP: Contrastive Language-Image Mamba Pretraining

    Jan 11, 2026Nimrod Shabtay, Itamar Zimerman, Eli Schwartz +1Cross-Modal LearningVLM Robustness

  6. Zoom-IQA: Image Quality Assessment with Reliable Region-Aware Reasoning

    Jan 6, 2026Guoqiang Liang, Jianyi Wang, Zhonghua Wu +2VLM RobustnessVLM Reasoning

  7. RGBT-GroundBench: Visual Grounding Beyond RGB in Complex Real-World Scenarios

    Dec 31, 2025Tianyi Zhao, Jiawen Xi, Linhui Xiao +4VLM RobustnessVisual Grounding

  8. High-Entropy Tokens as Multimodal Failure Points in Vision-Language Models

    Dec 26, 2025Mengqi He, Xinyu Tian, Xin Shen +4VLM RobustnessAdversarial Attacks on VLMs

  9. Counterfeit Answers: Adversarial Forgery against OCR-Free Document Visual Question Answering

    Dec 4, 2025Marco Pintore, Maura Pintor, Dimosthenis Karatzas +1Visual Question AnsweringVLM Robustness

  10. 6 Fingers, 1 Kidney: Natural Adversarial Medical Images Reveal Critical Weaknesses of Vision-Language Models

    Dec 3, 2025Leon Mayer, Piotr Kalinowski, Caroline Ebersbach +6VLM EvaluationVLM Robustness

  11. Understanding the Effects of Distractors on Reasoning Vision-Language Models

    Nov 26, 2025Jiyun Bae, Hyunjong Ok, Sangwoo Mo +1VLM EvaluationVisual Question Answering

  12. Diagnosing Corruption-Induced Reliability Failures in Vision-Language Models

    Nov 24, 2025Xiangjie Sui, Songyang Li, Hanwei Zhu +3VLM EvaluationVLM Robustness

  13. BackdoorVLM: A Benchmark for Backdoor Attacks and Defenses on Vision-Language Models

    Nov 24, 2025Juncheng Li, Yige Li, Hanxun Huang +5VLM EvaluationVLM Robustness

  14. Contrastive vision-language learning with paraphrasing and negation

    Nov 20, 2025Kwun Ho Ngan, Saman Sadeghi Afgeh, Joe Townsend +1VLM RobustnessVLM Reasoning

  15. Skin-R1: Clinical Knowledge-Guided Dermatological Diagnosis Using Vision-Language Models

    Nov 18, 2025Zehao Liu, Weijieying Ren, Jipeng Zhang +4VLM RobustnessMedical Diagnosis

  16. FoCLIP: A Feature-Space Misalignment Framework for CLIP-Based Image Manipulation and Detection

    Nov 10, 2025Yulin Chen, Zeyuan Wang, Tianyuan Yu +2VLM RobustnessAdversarial Attacks on VLMs

  17. VLOD-TTA: Test-Time Adaptation of Vision-Language Object Detectors

    Oct 1, 2025Atif Belal, Heitor R. Medeiros, Marco Pedersoli +1Open-Vocabulary Object DetectionVLM Robustness

  18. TokenSwap: Backdoor Attack on the Compositional Understanding of Large Vision-Language Models

    Sep 29, 2025Zhifang Zhang, Qiqi Tao, Jiaqi Lv +3VLM RobustnessAdversarial Attacks on VLMs

  19. VISOR: Visual Input-based Steering for Output Redirection in Vision-Language Models

    Aug 11, 2025Mansi Phute, Ravikumar BalakrishnanVLM RobustnessAdversarial Attacks on VLMs

  20. Can Argus Judge Them All? Comparing VLMs Across Domains

    Jun 23, 2025Harsh Joshi, Gautam Siddharth Kashyap, Rafiq Ali +5VLM EvaluationVLM Robustness

  21. SpurLens: Automatic Detection of Spurious Cues in Multimodal LLMs

    Mar 11, 2025Parsa Hosseini, Sumit Nawathe, Mazda Moayeri +2VLM EvaluationVLM Robustness

  22. Image-based Geo-localization for Robotics: Are Black-box Vision-Language Models there yet?

    Jan 28, 2025Sania Waheed, Bruno Ferrarini, Michael Milford +2VLM RobustnessCross-View Geo-Localization

  23. Exploiting Vision Encoder Vulnerabilities for Universal Adversarial Perturbations on Large Vision-Language Models

    Dec 11, 2024Hee-Seon Kim, Minbeom Kim, Seokil Ham +1VLM RobustnessAdversarial Attacks on VLMs

  24. VLMGuard: Bootstrapping Malicious Prompt Detectors from Unlabeled Vision-Language Prompts in the Wild

    Oct 1, 2024Junlin Fang, Wenyu Chen, Reshmi Ghosh +7VLM RobustnessVision-Language Models