Adversarial Training

Latest papers 115

All topics
CardsList
  1. Improving the Robustness/Accuracy Tradeoff Against Adversarial Attacks Using Information Bottleneck Distillation Through Dual Teachers

    Jul 30, 2026Vincent Ryusuke Takahashi, Yoshinari Takeishi, Jun'ichi Takeuchi +1Adversarial TrainingNeural Network Robustness

  2. GPT-Red: Automated Red Teaming via Self-Play at Scale

    Jul 28, 2026Eric Wallace, Christopher A. Choquette-Choo, Nikhil Kandpal +15Adversarial TrainingLLM Red Teaming

  3. Evaluation of Adversarial Robustness in Arabic Language Models

    Jul 28, 2026Anwar Alajmi, Ayed Salman, Imtiaz AhmadAdversarial TrainingArabic NLP

  4. Detectors Learn the Wrong Thing: Shortcut-Resistant Adversarial Training Against Physically Realizable Attacks

    Jul 23, 2026Yuanhao Huang, Yilong Ren, Jinlei Wang +3Adversarial TrainingAdversarial Robustness

  5. VanillaBench: The Hidden Accuracy Cost of Adversarial Robustness

    Jul 14, 2026Niklas BunzelAdversarial TrainingNeural Network Robustness

  6. Reducing information dependency does not cause training data privacy. Adversarially non-robust features do

    Jul 14, 2026Rasmus Torp, Shailen K. Smith, Adam BreuerAdversarial TrainingNeural Network Robustness

  7. World Models as Adversaries: Multi-Agent Self-Play Fine-Tuning for Robust Motion Planning

    Jul 12, 2026Tong Nie, Yuewen Mei, Junlin He +3Adversarial TrainingSelf-Play RL

  8. Efficient Safety Alignment of Language Models via Latent Personality Traits

    Jul 8, 2026Mohamed Amine Merzouk, Nolan Smyth, Damiano Fornasiere +3Adversarial TrainingLLM Safety Alignment

  9. RoME: Robust Mixture of Low-Rank Experts against Multiple Adversarial Perturbations

    Jul 7, 2026Woo Jae Kim, Kyle Min, Suhyeon Ha +2Adversarial TrainingNeural Network Robustness

  10. Adversarial LassoNet: Robust Feature Selection via Stability-Driven Sparse Learning

    Jul 4, 2026Zhen Huang, Peicheng Xu, Junbiao Pang +1Adversarial TrainingOOD Generalization

  11. A Step Towards Robust Unsupervised Domain Adaptation via Fine-Tuning and Reinforcement Learning

    Jul 3, 2026Sushant Dagaji Desale, Rahul Mishra, Ashutosh Kumar SinhaAdversarial TrainingUnsupervised Domain Adaptation

  12. ADP: Adversarial Dynamics Priors for Physically Grounded Humanoid Locomotion

    Jul 3, 2026Seokju Lee, Jeongtae Lee, Jeonghyeok Lim +6Adversarial TrainingHumanoid Robot Locomotion

  13. Robustness Meets Uncertainty: Evidential Adversarial Training for Robust Selective Classification

    Jul 3, 2026Nicolas Sournac, Ahmed Baha Ben Jmaa, Bertrand BraeckeveldtAdversarial TrainingEvidential Deep Learning

  14. Improving Adversarial Robustness via Activation Amplification and Attenuation

    Jun 26, 2026Taïga Gonçalves, Yongsong Huang, Tomo Miyazaki +1Adversarial TrainingNeural Network Robustness

  15. Enforcing Human-like Kinematics in Dexterous Piano Playing via Adversarial Posture Regularization

    Jun 22, 2026Bin Qiu, Yanming Shao, Guanyu Cai +1Adversarial TrainingDexterous Manipulation

  16. Robustness Cannot be Reduced to Regularization: Studying Adversarial Training Beyond the Linear Case

    Jun 19, 2026David A. R. Robin, Rafael Pinot, Yann ChevaleyreAdversarial TrainingNeural Network Robustness

  17. Convex training of Lipschitz-regularized shallow neural networks

    Jun 17, 2026Chao Yin, Antoine Lesage-LandryAdversarial TrainingShallow Neural Networks

  18. TaFD: Threat-Aware Frequency Decoupling for Adversarial Robustness against Heterogeneous Attacks

    Jun 16, 2026Mengda Xie, Yiling He, Meie FangAdversarial TrainingFrequency-Domain Feature Learning

  19. ROMPAR: Morphological Completion and Demographic Unlearning for Romanian-Accented Speech Recognition

    Jun 14, 2026Andrei-Marius Avram, Aureliu-Valentin Antonie, Ştefan-Bogdan Badea +3Adversarial TrainingDemographic Bias in ASR

  20. Defending against Adaptive Prompt Injection Attacks via Reasoning-enabled Task Alignment

    Jun 13, 2026Lipeng He, Yihan Wang, Jiawen Zhang +1Adversarial TrainingAI Agent Safety

  21. GRAPE: Guided Parameter-Space Evolution for Compact Adversarial Robustness

    Jun 12, 2026Zhiyuan Ye, Xiangyu Zhou, Ji Qi +2Adversarial TrainingNeural Network Robustness

  22. From Attacks to Curricula: Learnability-Guided Adversarial Training for Safe Autonomous Driving

    Jun 12, 2026Yuewen Mei, Tong Nie, Jie Sun +3Adversarial TrainingAutonomous Driving

  23. Contrast-Informed Augmentation and Domain-Adversarial Training for Adult-to-Neonatal MR Reconstruction Generalization

    Jun 11, 2026Stephen Moore, Lara Leijser, Richard Frayne +1Adversarial TrainingData Augmentation

  24. S-GBT: Smooth Growth Bound Tensor for Certified Robustness Against Word Substitution Attacks in NLP

    Jun 11, 2026Mohammed Bouri, Mohammed Erradi, Adnane SaoudAdversarial TrainingCertified Robustness

  25. Reinforcement Learning Disrupts Gradient-Based Adversarial Optimization

    Jun 10, 2026Xinhai Zou, Chang Zhao, Alireza Aghabagherloo +3Adversarial TrainingAdversarial Attacks

  26. Small Data, Big Noise: Adversarial Training for Robust Parameter-Efficient Fine-Tuning

    Jun 9, 2026Eitan Cohen, Idan Simai, Uri ShahamAdversarial TrainingNeural Network Robustness