Adversarial Attacks on VLMs

VLM: Vision-Language Model

Latest papers 106

All topics
CardsList
  1. Structure-Guided Visual Perturbation Neutralization for LVLMs

    May 27, 2026Yuanhe Zhang, Xueting Wang, YanBin Ren +6VLM RobustnessAdversarial Attacks on VLMs

  2. Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization

    May 26, 2026Xiang Fang, Wanlong Fang, Changshuo WangVLM RobustnessAdversarial Attacks on VLMs

  3. StructBreak: Structural Cognitive Overload-Induced Safety Failures in MLLMs

    May 25, 2026Yang Luo, Xinran Liu, Tiantian Ji +3Adversarial Attacks on VLMsLanguage Model Safety Evaluation

  4. Localization then Neutralization: Gradient-guided Token Suppression against Visual Prompt Injection Attack

    May 24, 2026Dongpeng Zhang, Ke Ma, Yangbangyan Jiang +4Gradient-Based AttributionVLM Robustness

  5. Furina: Fragmented Uncertainty-Driven Refusal Instability Attack

    May 24, 2026Tongxi Wu, Jian Zhang, Yang GaoAdversarial Attacks on VLMsLLM Safety

  6. Med-R2: An Adversarial Benchmark for Evidence-Grounded Reasoning in Medical VLMs

    May 23, 2026Wen Ma, Fucheng Niu, Zhiting Fan +3Adversarial Attacks on VLMsHealthcare

  7. Frequency-Domain Regularized Adversarial Alignment for Transferable Attacks against Closed-Source MLLMs

    May 20, 2026Leitao Yuan, Qinghua Mao, Daizong Liu +5Adversarial Attacks on VLMsMultimodal Large Language Models

  8. Towards Fine-Grained Robustness: Attention-Guided Test-Time Prompt Tuning for Vision-Language Models

    May 19, 2026Jia-Wei Hai, Yijun Wang, Xiu-Shen WeiVLM RobustnessAdversarial Attacks on VLMs

  9. Not What You Asked For: Typographic Attacks in Household Robot Manipulation

    May 18, 2026Ali Iranmanesh, Peng LiuAdversarial Attacks on VLMsRobotic Manipulation

  10. Attention Hijacking: Response Manipulation Across Queries in Vision-Language Models

    May 17, 2026Zhiqiang Wang, Dongrui Liu, Yan Li +4Adversarial Attacks on VLMsAdversarial Attacks

  11. Right Predictions, Misleading Explanations: On the Vulnerability of Vision-Language Model Explanations

    May 15, 2026Narges Babadi, Hadis KarimipourVLM RobustnessAdversarial Attacks on VLMs

  12. DarkLLM: Learning Language-Driven Adversarial Attacks with Large Language Models

    May 15, 2026Ye Sun, Xin Wang, Jiaming Zhang +7Adversarial Attacks on VLMsAdversarial Perturbations

  13. SafeSteer: A Decoding-level Defense Mechanism for Multimodal Large Language Models

    May 12, 2026Xinyi Zeng, Xue Yang, Jingyuan Zhang +5Adversarial Attacks on VLMsMultimodal Robustness

  14. Break the Brake, Not the Wheel: Untargeted Jailbreak via Entropy Maximization

    May 11, 2026Mengqi He, Xinyu Tian, Xin Shen +6Adversarial Attacks on VLMsAdversarial Attacks

  15. Knowledge Poisoning Attacks on Medical Multi-Modal Retrieval-Augmented Generation

    May 11, 2026Peiru Yang, Haoran Zheng, Tong Ju +6Multimodal RAGAdversarial Attacks on VLMs

  16. Adversarial Attacks Against MLLMs via Progressive Resolution Processing and Adaptive Feature Alignment

    May 11, 2026Haobo Wang, Xiaorong Ma, Weiqi Luo +2Adversarial Attacks on VLMsMultimodal Large Language Models

  17. Sparse Autoencoders as Plug-and-Play Firewalls for Adversarial Attack Detection in VLMs

    May 8, 2026Hao Wang, Yiqun Sun, Pengfei Wei +2VLM RobustnessAdversarial Attacks on VLMs

  18. GPO-V: Jailbreak Diffusion Vision Language Model by Global Probability Optimization

    May 8, 2026Yu Pan, Andi Zhang, Yi Wang +2Diffusion Model AlignmentAdversarial Attacks on VLMs

  19. Hard to Read, Easy to Jailbreak: How Visual Degradation Bypasses MLLM Safety Alignment

    May 8, 2026Zhixue Song, Boyan Han, Yiwei Wang +1VLM RobustnessAdversarial Attacks on VLMs

  20. Laundering AI Authority with Adversarial Examples

    May 5, 2026Jie Zhang, Pura Peetathawatchai, Florian Tramèr +1VLM RobustnessAdversarial Attacks on VLMs

  21. CBV: Clean-label Backdoor Attacks on Vision Language Models via Diffusion Models

    May 4, 2026Ji Guo, Xiaolong Qin, Cencen Liu +3VLM RobustnessAdversarial Attacks on VLMs

  22. Jailbreaking Vision-Language Models Through the Visual Modality

    May 1, 2026Aharon Azulay, Jan Dubiński, Zhuoyun Li +2Adversarial Attacks on VLMsVision-Language Models