Neural Network Robustness

Latest papers 173

All topics
CardsList
  1. HARVE: Hacking-Aware Reward-Head Vector Editing for Robust Reward Models

    Jun 2, 2026Shuang Liu, Yuxuan Bo, Qiuyang Zhao +4Reward ModelingReward Hacking

  2. RRISE: Robust Radius Inference via a Surrogate Estimator

    Jun 1, 2026Jong-Ik Park, Shreyas Chaudhari, Carlee Joe-Wong +1Randomized SmoothingNeural Network Robustness

  3. Rethinking Evaluation Paradigms in IBP-based Certified Training

    Jun 1, 2026Konstantin Kaulen, Hadar Shavit, Holger H. HoosNeural Network VerificationNeural Network Robustness

  4. CEAR: Certified Ensemble Adversarial Robustness in DNNs

    May 31, 2026Daniel Sadig, Mohammadreza Maleki, Hamed Karimi +1Neural Network RobustnessAdversarial Robustness

  5. Quantum Tunneling-Aware Machine Learning: Physics-Derived Noise Models for Robust Deployment

    May 30, 2026Uiwon Hwang, Jaeho HwangNeural Network RobustnessPhysics-Informed ML

  6. SORA: Free Second-Order Attacks in Fast Adversarial Training

    May 30, 2026Mazdak Teymourian, Ramtin Moslemi, Farzan Rahmani +1Adversarial TrainingNeural Network Generalization

  7. TASER: Task-Aware Stein Regularisation for Geometry-Driven Robustness

    May 28, 2026Michał Kozyra, Gesine ReinertDistribution Shift RobustnessNeural Network Robustness

  8. Improving Adversarial Robustness of Attribution via Implicit Regularization

    May 28, 2026Amir Mehrpanah, Matteo Gamba, Hossein AzizpourTransformer InterpretabilityNeural Network Robustness

  9. Harnessing non-adversarial robustness in large language models

    May 28, 2026Qinghua Zhou, Ellina Aleshina, Andrey Lovyagin +6LLM Fine-TuningNeural Network Robustness

  10. TRACER: Persistent Regularization for Robust Multimodal Finetuning

    May 28, 2026Hesam Asadollahzadeh, Feng Liu, Christopher Leckie +1VLM RobustnessNeural Network Robustness

  11. Beyond Lipschitz: Data-Driven Robustness via Discrete Modulus of Continuity

    May 27, 2026Jürgen Dölz, Michael Multerer, Michele PalmaNeural Network RobustnessAdversarial Robustness

  12. When Muon Optimizer Meets Adversarial Training: A Theoretical and Empirical Study

    May 26, 2026Jun Yan, Weiquan Huang, Jiankai Zuo +4Adversarial TrainingNeural Network Optimization

  13. Certified Robustness from Approximate Gaussian Mixture Structures in Pretrained Latent Spaces

    May 25, 2026Konstantinos Emmanouilidis, Tianjiao Ding, Nghia Nguyen +2Neural Network RobustnessAdversarial Robustness

  14. Toward Understanding Adversarial Distillation: Why Robust Teachers Fail

    May 21, 2026Hongsin Lee, Hye Won ChungAdversarial TrainingNeural Network Robustness

  15. Mind Your Margin and Boundary: Are Your Distilled Datasets Truly Robust?

    May 20, 2026Muquan Li, Yingyi Ma, Yihong Huang +5Neural Network RobustnessAdversarial Robustness

  16. Symmetrization of Loss Functions for Robust Training of Neural Networks in the Presence of Noisy Labels

    May 19, 2026Alexandre Lemire Paquin, Brahim Chaib-Draa, Philippe GiguèreNeural Network RobustnessNoisy-Label Learning

  17. SDM: A Powerful Tool for Evaluating Model Robustness

    May 19, 2026Xinlei Liu, Tao Hu, Jichao Xie +3Adversarial AttacksNeural Network Robustness

  18. Updating the standard neuron model in artificial neural networks

    May 19, 2026Raul Mohedano, Thomas Batard, Erik Velasco-Salido +4Neural Network RobustnessNeural Network Expressivity

  19. MedFM-Robust: Benchmarking Robustness of Medical Foundation Models

    May 18, 2026Xiangxiang Cui, Tianjin Huang, Yifang Wang +2Multimodal RobustnessNeural Network Robustness

  20. UniAlign: A Model-Agnostic Framework for Robust Network Traffic Classification under Distribution Shifts

    May 17, 2026Tongze Wang, Xiaohui Xie, Wenduo Wang +2Distribution Shift RobustnessDomain Adaptation

  21. Stress-Testing Neural Network Verifiers with Provably Robust Instances

    May 16, 2026David Troxell, Yulia Alexandr, Sofia Hunt +2Neural Network VerificationNeural Network Robustness

  22. Semantic Smoothing via Novel View Synthesis for Robust SAR Image Classification

    May 15, 2026Daniel Brignac, Fengwei Tian, Banafsheh Latibari +2Randomized SmoothingAdversarial Attacks

  23. LPDS: Evaluating LLM Robustness Through Logic-Preserving Difficulty Scaling

    May 14, 2026Philipp Mondorf, Samuel J. Bell, Jesse Dodge +1LLM EvaluationNeural Network Robustness

  24. Fast Adversarial Attacks with Gradient Prediction

    May 14, 2026Kamil Ciosek, Aleksandr V. Petrov, Nicolò Felicioni +1Adversarial AttacksNeural Network Robustness

  25. Dual-axis attribution of zebrafish tectal microcircuits for energy-efficient and robust neurocomputing

    May 13, 2026Ningping Li, Hao Zhang, Yi ZhouEfficient Neural Network InferenceNeural Processes