Black-Box Adversarial Attacks

Latest papers 115

All topics
CardsList
  1. Assessing Automated Prompt Injection Attacks in Agentic Environments

    Jun 9, 2026David Hofer, Edoardo Debenedetti, Florian TramèrAdversarial Prompt GenerationLLM Agent Security

  2. What the Eyes See, the LLMs Miss: Exploiting Human Perception for Adversarial Text Attacks

    Jun 8, 2026Qin Yang, Lu Malloy, Joshua Lee +4Language Model Safety EvaluationBlack-Box Adversarial Attacks

  3. SHIELD-IDS: Structurally Heterogeneous Ensemble with Integrated Layered Defense for Intrusion Detection Systems

    Jun 5, 2026Maryam Zaman, Muhammad Khuram ShahzadEnsemble LearningNetwork Intrusion Detection

  4. Beyond Waveform Robustness: Robust Feature-Vocoder Adversarial Attacks on Automatic Speech Recognition

    Jun 4, 2026Yifan Liao, Zongmin Zhang, Zhen Sun +3Adversarial AttacksTransfer-Based Adversarial Attacks

  5. FoeGlass: Simple In-Context Learning Is Enough for Red Teaming Audio Deepfake Detectors

    Jun 3, 2026Sepehr Dehdashtian, Jacob H Seidman, Vishnu N Boddeti +1Audio Deepfake DetectionAdversarial Robustness

  6. Black-box, Adaptive, Efficient, Transferable, Harmful, Applicable... Attacks Are All You Need to Break LLMs

    Jun 2, 2026Vincent Limbach, Jonas Dornbusch, David Lüdke +2LLM Jailbreak AttacksLLM Safety Evaluation

  7. ATLAS: A Large-Scale Evaluation Benchmark for Adversarial LiDAR Perception

    Jun 1, 2026Mellon M. Zhang, Siddhant Panse, Zimo Fan +3Lidar-Based 3D Object DetectionAdversarial Attacks

  8. MaskForge: Structure-Aware Adaptive Attacks for Jailbreaking Diffusion Large Language Models

    Jun 1, 2026Yingzi Ma, Zhengyue Zhao, Xiaogeng Liu +3Masked Diffusion ModelsAdversarial Attacks on LLMs

  9. DiscourseFlip: An Oblique Discourse-Level Opinion Manipulation Attack against Black-box Retrieval-Augmented Generation

    May 31, 2026Yuyang Gong, Miaokun Chen, Jiawei Liu +5RAG Poisoning AttacksRAG Security

  10. Latent Geometric Chords for Query-Efficient Decision-Based Adversarial Attacks

    May 29, 2026Ei Hmue Khine, Yao Li, Jiebao Sun +3Adversarial AttacksAdversarial Perturbations

  11. EvoDefense: Co-Evolving Black-Box Defense with Large Language Models

    May 29, 2026Yu Li, Yuenan Hou, Yingmei Wei +2Evolutionary OptimizationAdversarial Attacks on LLMs

  12. Audio Pirates: Black-box Audio Watermark Removal via Diffusion Priors

    May 28, 2026Lingfeng Yao, Xincong Zhong, Chenpei Huang +6Watermark RemovalAudio Watermarking

  13. Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization

    May 26, 2026Xiang Fang, Wanlong Fang, Changshuo WangVLM RobustnessAdversarial Attacks on VLMs

  14. Erased but Exploitable: Black-box Embedding-Aware Prompting Against Unlearned Text-to-Image Diffusion Models

    May 25, 2026Arian Komaei Koma, Seyed Amir Kasaei, AmirMahdi Sadeghzadeh +1Adversarial Prompt GenerationAdversarial Attacks

  15. SEP-Attack: A Simple and Effective Paradigm for Transfer-Based Textual Adversarial Attack

    May 24, 2026Han Liu, Zhi Xu, Xiaotong Zhang +5Determinantal Point ProcessTransfer-Based Adversarial Attacks

  16. IterInject: Indirect Prompt Injection Against LLM Agents via Feedback-Guided Iterative Optimization

    May 23, 2026Zixuan Chen, Jiaxiang Chen, Li Luo +4LLM Agent SecurityIndirect Prompt Injection

  17. LASH: Adaptive Semantic Hybridization for Black-Box Jailbreaking of Large Language Models

    May 20, 2026Abdullah Al Nomaan Nafi, Fnu Suya, Swarup Bhunia +1Adversarial Prompt GenerationLLM Jailbreak Attacks

  18. Learning to Look Benign: Targeted Evasion of Malware Detectors via API Import Injection

    May 18, 2026Juozas Dautartas, Olga Kurasova, Juozapas Rokas Čypas +1Adversarial AttacksMalware Classification

  19. Attacking the First-Principle: A Black-Box, Query-Free Targeted Mimicry Attack on Binary Function Classifiers

    May 18, 2026Gabriel Sauger, Jean-Yves Marion, Sazzadur Rahaman +3Adversarial AttacksMalware Classification

  20. Whispers in the Noise: Surrogate-Guided Concept Awakening via a Multi-Agent Framework

    May 18, 2026Mengyu Sun, Ziyuan Yang, Zunlong Zhou +3Adversarial AttacksBlack-Box Adversarial Attacks

  21. An Empirical Study of Privacy Leakage Chains via Prompt Injection in Black-Box Chatbot Environments

    May 18, 2026Hongjang Yang, Hyunsik Na, Daeseon ChoiData LeakagePrivacy Leakage in Language Models

  22. Threats to Arabic Handwriting Recognition: Investigating Black-Box Adversarial Attacks on embedded ConvNet models

    May 18, 2026Mohsine EL Khayati, Abdelillah Semma, Abdelaziz Courr +1Adversarial RobustnessBlack-Box Adversarial Attacks

  23. Babel: Jailbreaking Safety Attention via Obfuscation Distribution Optimized Sampling

    May 18, 2026Ziwei Wang, Jing Chen, Ruichao Liang +6LLM SafetyLLM Jailbreak Attacks

  24. MoCo-EA: Exploiting Adversarial Mode Connectivity for Efficient Evolutionary Attacks

    May 18, 2026Hyo Seo Kim, Gang Luo, Can Chen +3Evolutionary OptimizationAdversarial Attacks

  25. Escaping the Linearity Trap: Manifold Detours for Black-Box Adversarial Attacks on Singing Audio Deepfake Detection

    May 18, 2026Yifan Liao, Yule Liu, Zhen Sun +5Audio Deepfake DetectionTransfer-Based Adversarial Attacks

  26. Towards Universal Physical Adversarial Attacks via a Joint Multi-Objective and Multi-Model Optimization Framework

    May 18, 2026Ziyang Liu, Hongyuan Wang, Zijian Wang +4Transfer-Based Adversarial AttacksBlack-Box Adversarial Attacks

  27. Red-Teaming Agent Execution Contexts: Open-World Security Evaluation on OpenClaw

    May 11, 2026Hongwei Yao, Yiming Liu, Yiling He +1AI Agent SecurityLLM Agent Security