Adversarial Training

Latest papers 115

All topics
CardsList
  1. Fight Poison with Poison: Enhancing Robustness in Few-shot Machine-Generated Text Detection with Adversarial Training

    May 4, 2026Wenjing Duan, Qi Zhou, Yuanfan LiAdversarial TrainingAI-Generated Text Detection

  2. Manifold-Constrained Adversarial Training for Long-Tailed Robustness via Geometric Alignment

    May 4, 2026Guanmeng Xian, Ning Yang, Philip S. YuAdversarial TrainingLong-Tailed Classification

  3. Asymmetric Invertible Threat: Learning Reversible Privacy Defense for Face Recognition

    May 2, 2026Jiabei Zhang, Ziyuan Yang, Andrew Beng Jin Teoh +1Adversarial TrainingAdversarial Attacks

  4. Quantum Interval Bound Propagation for Certified Training of Quantum Neural Networks

    May 1, 2026Emma Andrews, Nahyeon Kim, Prabhat MishraAdversarial TrainingAdversarial Robustness

  5. Dynamic Adversarial Fine-Tuning Reorganizes Refusal Geometry

    Apr 29, 2026Wenhao Lan, Shan Li, Xinhua Lai +4Adversarial TrainingLanguage Model Safety Evaluation

  6. SafeReview: Defending LLM-based Review Systems Against Adversarial Hidden Prompts

    Apr 29, 2026Yuan Xin, Yixuan Weng, Minjun Zhu +5Adversarial TrainingAdversarial Prompt Generation

  7. Unveiling the Backdoor Mechanism Hidden Behind Catastrophic Overfitting in Fast Adversarial Training

    Apr 27, 2026Mengnan Zhao, Lihe Zhang, Tianhang Zheng +2Adversarial TrainingNeural Network Generalization

  8. Mitigating Error Amplification in Fast Adversarial Training

    Apr 27, 2026Mengnan Zhao, Lihe Zhang, Bo Wang +3Adversarial TrainingNeural Network Generalization

  9. FastAT Benchmark: A Comprehensive Framework for Fair Evaluation of Fast Adversarial Training Methods

    Apr 22, 2026Chao Pan, Xin YaoAdversarial TrainingAdversarial Robustness

  10. Benign Overfitting in Adversarial Training for Vision Transformers

    Apr 21, 2026Jiaming Zhang, Meng Ding, Shaopeng Fu +2Adversarial TrainingNeural Network Generalization

  11. Improving LLM Code Reasoning via Semantic Equivalence Self-Play with Formal Verification

    Apr 18, 2026Antonio Valerio Miceli Barone, Poon Tsz NokAdversarial TrainingSelf-Play RL

  12. Dual-Modality Multi-Stage Adversarial Safety Training: Robustifying Multimodal Web Agents Against Cross-Modal Attacks

    Mar 4, 2026Haoyu Liu, Dingcheng Li, Lukas Rutishauser +1Adversarial TrainingMultimodal Robustness

  13. A swap-adversarial framework for improving domain generalization in electrocorticography-based Parkinson's disease classification

    Feb 11, 2026Seongwon Jin, Hanseul Choi, Sunggu Yang +2Adversarial TrainingData Augmentation

  14. Adversarial Reward Auditing for Active Detection and Mitigation of Reward Hacking

    Feb 2, 2026Mohammad Beigi, Ming Jin, Junshan Zhang +2Adversarial TrainingReward Hacking

  15. Noise-Aware and Dynamically Adaptive Federated Defense Framework for SAR Image Target Recognition

    Dec 31, 2025Yuchao Hou, Zixuan Zhang, Jie Wang +9Adversarial TrainingRemote Sensing

  16. destroR: A Benchmark and Adversarial-Training Defense for Bangla Transfer Models under Meaning-Preserving Attacks

    Nov 13, 2025Saadat Rafid Ahmed, Rubayet Shareen, Radoan Sharkar +3Adversarial TrainingSentiment Analysis

  17. CogniDir: Combating Cognitive Malicious Comments via Adaptive Distributional Learning for Robust Fake News Detection

    Oct 10, 2025Zhao Tong, Chunlin Gong, Yimeng Gu +5Adversarial TrainingFake News Detection

  18. On the Escaping Efficiency of Distributed Adversarial Training Algorithms

    Sep 14, 2025Ying Cao, Kun Yuan, Ali H. SayedAdversarial TrainingAdversarial Robustness

  19. Unified Enhancement of the Generalization and Robustness of Language Models via Bi-Stage Optimization

    Mar 19, 2025Yudao Sun, Juan Yin, Juan Zhao +3Adversarial TrainingNeural Network Generalization

  20. How Learning Dynamics Drive Adversarially Robust Generalization?

    Oct 10, 2024Yuelin Xu, Xiao ZhangAdversarial TrainingPAC-Bayesian Generalization Bounds