Adversarial Attacks on VLMs

VLM: Vision-Language Model

Latest papers 106

All topics
CardsList
  1. Detecting Adversarial Images through Response Profiles of Vision-Language Models

    Oct 7, 2026Arash Vashagh, Roozbeh Razavi-FarAdversarial Example DetectionVLM Robustness

  2. Understanding and Mitigating Token-Pruning-Induced Vulnerabilities in VLMs

    Oct 7, 2026Shuailong Wang, Xinyu Lyu, Shengming Yuan +3Visual Token PruningVLM Robustness

  3. Visual Memory Attacks Can Persist Through The KV Cache

    Oct 6, 2026David Dobre, Leo Schwinn, Gauthier Gidel +3Adversarial Attacks on VLMsBackdoor Attacks on VLMs

  4. Walking the Embedding Space: Datastore Extraction from Multimodal RAG

    Oct 1, 2026Maria Carmen Jica, Ali Satvaty, Suzan Verberne +1Multimodal RAGAdversarial Attacks on VLMs

  5. Typographic Attack Against VLM-based AI-generated Image Detection

    Sep 30, 2026Eunmin Lee, Jungwoo Kim, Jong-Seok LeeVLM EvaluationVLM Robustness

  6. Feature-Aware Token Attack for Compression-Triggered Stealthy Failures in Large Vision-Language Models

    Sep 30, 2026Shilinlu Yan, Bowen Chen, Yuechen Zhang +3VLM RobustnessAdversarial Attacks on VLMs

  7. Still There, No Longer Seen: Exposing Compression-Induced Risk in Large Vision-Language Models

    Sep 28, 2026Qiankun Li, Yuechen Zhang, Bowen Chen +4VLM RobustnessAdversarial Attacks on VLMs

  8. One Attack to Fool Them All: Highly Transferable Black-Box Adversarial Attacks on Frontier MLLMs

    Sep 27, 2026Sen Nie, Jie Zhang, Zhongqi Wang +2Adversarial Attacks on VLMsAdversarial Attacks on LLMs

  9. Hiding in Plain Sight: A Diffusion-based Mitigation of Geolocation Privacy Leakage in Vision-Language Models

    Sep 18, 2026Yining Wang, Xi Li, Mi Zhang +4Privacy Protection in VLMsAdversarial Attacks on VLMs

  10. Do Input-Level Defenses Transfer to Observation-Level Attacks on VideoLLMs?

    Sep 8, 2026Bangshuo Zhu, Wei Song, Yuxin Cao +4VLM RobustnessAdversarial Attacks on VLMs

  11. MM-IFEval-Pro: A Multilingual and Attack-Resistant Benchmark for Instruction-Following in Vision-Language Models

    Sep 4, 2026Changming Xiao, Zhenliang Ni, Jinhui He +2VLM RobustnessAdversarial Attacks on VLMs

  12. Jailbreaking Text-to-Image Models Through Cracks: Navigating Heterogeneous Safety Filters via Multi-Agent Debate

    Sep 1, 2026Kaiyan Wen, Shijie Zhang, Lu Yu +1Adversarial Attacks on VLMsMulti-Agent Debate

  13. Forbid Your Attention: Fooling Multimodal Large Language Models by Selectively Removing Intrinsic Focus in Spectral Domain

    Sep 1, 2026Daizong Liu, Junhao Dong, Zhiyuan Ma +6Adversarial Attacks on VLMsAdversarial Attacks

  14. Fully Unleashing the Multimodal Attacker: Meta-Adaptive Jailbreaking of Vision-Language Models

    Aug 27, 2026Benlei Cui, Shen Pang, Yuke Wang +7VLM RobustnessAdversarial Attacks on VLMs

  15. QuISE: Defense against Typographic Attacks on VLMs via Query-Irrelevant Semantic Editing

    Aug 13, 2026Shubin Lu, Jiaqi Yin, Yihao HuangVLM RobustnessAdversarial Attacks on VLMs

  16. Once Poisoned, Arbitrarily Controlled: A Programmable Backdoor in VLMs

    Aug 11, 2026Tao Lin, Gaojie Jin, Zongxin Liu +2Adversarial Attacks on VLMsVision-Language Models

  17. SafeCap: Improving LVLM Safety with Image Captioning Reinforcement Learning

    Aug 11, 2026Caoyuan Ma, Wenpu Liu, Weichu Xie +12VLM RobustnessAdversarial Attacks on VLMs

  18. Adversarial Attacks on Deep OCR Systems

    Aug 7, 2026Wenbo Sun, Hongzong LI, Yanyun Wang +5Adversarial Attacks on VLMsAdversarial Attacks

  19. Vision-Language Model Confidence Is Not a Property of the Answer

    Aug 6, 2026Reza Khanmohammadi, Erfan Miahi, Ivan Brugere +4VLM RobustnessAdversarial Attacks on VLMs

  20. Hijacking Robots with a Piece of Paper: A Systematic Study of Physical Prompt Injection in VLM-Controlled Robots

    Aug 6, 2026S. M . Bhagya P. Samarakoon, M. A. Viraj J. Muthugala, W. K. R. Sachinthana +1VLM RobustnessAdversarial Attacks on VLMs

  21. Two Sides of the Same Coin: Co-Evolving Search for Cross-Task Attacks on Vision-Language Models

    Aug 3, 2026Xuanhui Lin, Junhao Dong, Mingrong Gong +3VLM RobustnessAdversarial Attacks on VLMs

  22. Fighting Fire with Fire: On the Feasibility of Protecting Exercises Against AI Cheating

    Aug 2, 2026Tobias Braun, Jonas Grebe, Louis Rethfeld +1Adversarial Attacks on VLMsAI in Education

  23. ReACT-CLIP: Response-Aware Test-Time Defense for Vision--Language Models

    Aug 2, 2026Hashmat Shadab Malik, Toluwani Aremu, Samuele Poppi +2VLM RobustnessAdversarial Attacks on VLMs

  24. A Cross-Architecture Audit of Direction-Based Inference-Time Defences in Vision-Language Models

    Jul 30, 2026Xiangyu Yin, Tora Bodin, Rohan Menon +1VLM RobustnessAdversarial Attacks on VLMs