Black-Box Adversarial Attacks

Latest papers 115

All topics
CardsList
  1. Adversarial Attacks Against MLLMs via Progressive Resolution Processing and Adaptive Feature Alignment

    May 11, 2026Haobo Wang, Xiaorong Ma, Weiqi Luo +2Adversarial Attacks on VLMsMultimodal Large Language Models

  2. LLM-Agnostic Semantic Representation Attack

    May 9, 2026Jiawei Lian, Jianhong Pan, Lefan Wang +4Adversarial Prompt GenerationAdversarial Attacks on LLMs

  3. On the Hardness of Junking LLMs

    May 6, 2026Marco Rando, Samuel VaiterLLM Backdoor AttacksLLM Jailbreak Attacks

  4. Fight Poison with Poison: Enhancing Robustness in Few-shot Machine-Generated Text Detection with Adversarial Training

    May 4, 2026Wenjing Duan, Qi Zhou, Yuanfan LiAdversarial TrainingAI-Generated Text Detection

  5. Led to Mislead: Adversarial Content Injection for Attacks on Neural Ranking Models

    May 2, 2026Amin Bigdeli, Amir Khosrojerdi, Radin Hamidi Rad +3Learning to RankAdversarial Attacks

  6. Low Rank Adaptation for Adversarial Perturbation

    Apr 30, 2026Han Liu, Shanghao Shi, Yevgeniy Vorobeychik +2Adversarial AttacksLow-Rank Approximation

  7. Agentic Adversarial Rewriting Exposes Architectural Vulnerabilities in Black-Box NLP Pipelines

    Apr 26, 2026Mazal Bethany, Kim-Kwang Raymond Choo, Nishant Vishwamitra +1Fake News DetectionAdversarial Prompt Generation

  8. EvoJail: Evolutionary Diverse Jailbreak Prompt Generation for Large Language Models

    Apr 22, 2026Rui Tang, Kaiyu Xu, Pengsen Cheng +3Adversarial Prompt GenerationLLM Jailbreak Attacks

  9. Beyond Explicit Refusals: Soft-Failure Attacks on Retrieval-Augmented Generation

    Apr 20, 2026Wentao Zhang, Yan Zhuang, ZhuHang Zheng +3Retrieval-Augmented GenerationRAG Security

  10. When Background Matters: Breaking Medical Vision Language Models by Transferable Attack

    Apr 19, 2026Akash Ghosh, Subhadip Baidya, Sriparna Saha +1VLM RobustnessAdversarial Attacks on VLMs

  11. Route to Rome Attack: Directing LLM Routers to Expensive Models via Adversarial Suffix Optimization

    Apr 16, 2026Haochun Tang, Yuliang Yan, Jiahua Lu +2Adversarial Prompt GenerationCost-Aware Inference

  12. Physically-Induced Atmospheric Adversarial Perturbations: Enhancing Transferability and Robustness in Remote Sensing Image Classification

    Apr 16, 2026Weiwei Zhuang, Wangze Xie, Qi Zhang +9Remote Sensing Image UnderstandingTransfer-Based Adversarial Attacks

  13. Are GUI Agents Focused Enough? Automated Distraction via Semantic-level UI Element Injection

    Apr 9, 2026Wenkui Yang, Chao Jin, Haisu Zhu +7GUI AgentsAI Agent Security

  14. SEBA: Sample-Efficient Black-Box Attacks on Visual Reinforcement Learning

    Nov 12, 2025Tairan Huang, Yulin Jin, Junxu Liu +2Adversarial AttacksAdversarial Perturbations

  15. Consensus-based optimization for closed-box adversarial attacks and a connection to evolution strategies

    Jun 30, 2025Tim Roith, Leon Bungert, Philipp WackerEvolutionary OptimizationBlack-Box Adversarial Attacks

  16. HauntAttack: When Attack Follows Reasoning as a Shadow

    Jun 8, 2025Jingyuan Ma, Rui Li, Zheng Li +4Adversarial Attacks on LLMsJailbreak Attacks

  17. Adversarial Robustness of AI-Generated Image Detectors in the Real World

    Oct 2, 2024Sina Mavali, Jonas Ricker, David Pape +2Adversarial AttacksAdversarial Robustness

  18. Perturbation Effects on Robustness and Individual Fairness

    Apr 1, 2024Xuran Li, Hao Xue, Peng Wu +4Neural Network RobustnessAlgorithmic Fairness

  19. SUB-PLAY: Adversarial Policies against Partially Observed Multi-Agent Reinforcement Learning Systems

    Feb 6, 2024Oubo Ma, Yuwen Pu, Linkang Du +5Adversarial AttacksPartially Observable RL

  20. InstructTA: Instruction-Tuned Targeted Attack for Large Vision-Language Models

    Dec 4, 2023Xunguang Wang, Pingchuan Ma, Zhenlan Ji +3Adversarial Attacks on VLMsLarge Vision-Language Models

  21. Spectral Masking and Interpolation Attack (SMIA): A Black-box Adversarial Attack against Voice Authentication and Anti-Spoofing Systems

    Date pendingKamel Kamel, Hridoy Sankar Dutta, Keshav Sood +1Audio Deepfake DetectionSpeaker Verification