Adversarial Text Attacks

Latest papers 49

All topics
CardsList
  1. EASE: Entropy-Adaptive Distribution Shaping for Evading AI-generated Text Detectors

    Oct 7, 2026Jicheng Zhou, Kahim Wong, Jialong Wang +1Adversarial Text AttacksRobustness of Machine-Generated Text Detection

  2. DeBERTa-ConPara: Attack-Aware and Deployment-Realistic Detection of AI-Generated Text

    Oct 1, 2026Mohamed Mady, Yupei Li, Johannes Reschke +1AI-Generated Text DetectionAdversarial Robustness of Language Models

  3. OASIS: Optimizing Attacker Sequences for Hard-Label Black-Box Text Attacks

    Aug 30, 2026Qian Chen, Shiliang Xiao, Yuzhi LiangAdversarial AttacksBlack-Box Adversarial Attacks

  4. Build it, Break it, Repeat: Benchmarking and improving LLM-manipulated disinformation detection in social media posts

    Aug 10, 2026Kevin Thomas, Milosz Kasprzyk, Reuel C Igbokwe Onuigbo +5AI-Generated Text DetectionAdversarial Robustness of Language Models

  5. Evaluation of Adversarial Robustness in Arabic Language Models

    Jul 28, 2026Anwar Alajmi, Ayed Salman, Imtiaz AhmadAdversarial TrainingArabic NLP

  6. Occluded Oculus: Operationalizing Stylistic Obscurement

    Jul 27, 2026Robert DilworthStylometryAdversarial Text Attacks

  7. Adversarial Robustness of Phishing Email Detection: A Comparative Study of TF-IDF + Logistic Regression and Fine-Tuned DistilBERT

    Jul 20, 2026Tanveer Ahmed, Seyedali PourmoafilAdversarial RobustnessCybersecurity

  8. Seduced by the Narrative: Assessing Rule Adherence in Semi-Open Textual Sandboxes

    Jul 2, 2026Weiying Chen, Junlong Shen, Zhanyuan Guo +1LLM Safety BenchmarksAdversarial Prompt Generation

  9. Triospect: A Three-Dimensional Framework for Robust Statistical AI-Generated Text Detection Against Diverse Attacks

    Jun 30, 2026Guangsheng Bao, Lihua Rong, Yanbin Zhao +3AI-Generated Text DetectionRobustness of Machine-Generated Text Detection

  10. Vulnerability of Natural Language Classifiers to Evolutionary Generated Adversarial Text

    Jun 25, 2026Manjinder Singh, Alexander E. I. Brownlee, Mohamed ElawadyAdversarial AttacksBlack-Box Adversarial Attacks

  11. Generalised Eigenvalue Geometry of Semantic Adversarial Attacks

    Jun 17, 2026Martin Anthony, Kaveh Salehzadeh NobariAdversarial RobustnessAdversarial Text Attacks

  12. GAS-Leak-LLM: Genetic Algorithm-Based Suffix Optimization for Black-Box LLM Jailbreaking

    Jun 14, 2026Aman Anifer, Vignesh Kumar Kembu, Vishnu M +4Adversarial Prompt GenerationLLM Safety

  13. S-GBT: Smooth Growth Bound Tensor for Certified Robustness Against Word Substitution Attacks in NLP

    Jun 11, 2026Mohammed Bouri, Mohammed Erradi, Adnane SaoudAdversarial TrainingCertified Robustness

  14. No Hidden Prompts Needed! You Can Game AI Peer Review with Presentation-Only Revisions

    Jun 11, 2026Xu Yang, Zhizhou Sha, Junbo Li +10Adversarial AttacksAutomated Peer Review

  15. What the Eyes See, the LLMs Miss: Exploiting Human Perception for Adversarial Text Attacks

    Jun 8, 2026Qin Yang, Lu Malloy, Joshua Lee +4Language Model Safety EvaluationBlack-Box Adversarial Attacks

  16. Detector-Evasive LLM Paraphrasing via Constrained Policy Optimization

    May 29, 2026Mingyi Wang, Zhuoer Shen, Yuheng Bu +1Constrained RLText Generation

  17. GEO-Bench: Benchmarking Ranking Manipulation in Generative Engine Optimization

    May 27, 2026Ojas Nimase, Zhe Chen, Gengpei Qi +2Generative Engine OptimizationAdversarial Attacks

  18. Unveiling the Fragility of Vision-Language Models: Multi-Modal Adversarial Synergy via Texture-Constrained Perturbations and Cross-Modal Optimization

    May 26, 2026Xiang Fang, Wanlong Fang, Changshuo WangVLM RobustnessAdversarial Attacks on VLMs

  19. SEP-Attack: A Simple and Effective Paradigm for Transfer-Based Textual Adversarial Attack

    May 24, 2026Han Liu, Zhi Xu, Xiaotong Zhang +5Determinantal Point ProcessTransfer-Based Adversarial Attacks

  20. Turning Bias into Bugs: Bandit-Guided Style Manipulation Attacks on LLM Judges

    May 24, 2026Xianglin Yang, Bryan Hooi, Gelei Deng +2LLM EvaluationLLM-as-a-Judge

  21. Harder to Defend: Towards Chinese Toxicity Attacks via Implicit Enhancement and Obfuscation Rewriting

    May 21, 2026Jingyi Kang, Junyu Lu, Bo Xu +4Language Model Safety EvaluationToxicity Detection

  22. SCI-Defense: Defending Manipulation Attacks from Generative Engine Optimization

    May 21, 2026Xucheng Yu, Haibo Jin, Huimin Zeng +1LLM RerankingAdversarial Example Detection

  23. Babel: Jailbreaking Safety Attention via Obfuscation Distribution Optimized Sampling

    May 18, 2026Ziwei Wang, Jing Chen, Ruichao Liang +6LLM SafetyLLM Jailbreak Attacks

  24. Universal Adversarial Triggers

    May 18, 2026Benedict Florance Arockiaraj, Alexander Feng, Jianxiong Cai +1Adversarial AttacksAdversarial Text Attacks

  25. The Capability Paradox: How Smarter Auditors Make Multi-Agent Systems Less Secure

    May 17, 2026Qiqi Liu, Thorsten Holz, Shilin Ye +1Multi-Agent LLM SystemsMulti-Agent System Security