Prompt Robustness

Momentum

0 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 12

All topics
CardsList
  1. Prompt-Robust Language Models: Which Training Strategies Work?

    Sep 1, 2026Frederic Sadrieh, Michal ŠtefánikPrompt SensitivityLLM Fine-Tuning

  2. Refusing Intent, Not Form: Wrapper-Based Intent-Group Supervision for LLM Safety

    Aug 13, 2026Ping Wu, Haibo Tong, Feifei Zhao +7LLM Safety AlignmentLLM Refusal Behavior

  3. Improving Generalization Robustness of Multimodal RLVR

    Aug 9, 2026Pengfei Zhou, Zhiwei Tang, Xiaopeng Peng +11Multimodal RobustnessMultimodal Large Language Models

  4. BASIS: Breach-Aware Selective Prompt Injection Shielding with Prefill Attention Probes

    Aug 8, 2026Laiqiao Qin, Tianqing Zhu, Longxiang Gao +1Prompt Injection DefensePrompt Injection Attacks on LLMs

  5. Prompt Robustness Is Task-Dependent: Comparing Objective and Belief-Style Questions in LLM Evaluation

    Jul 6, 2026Sadia Kamal, Arefa Patwary, Anthony Marchiafava +2LLM EvaluationLanguage Model Generation Evaluation

  6. MPSelectTune: Prompt-type Selection for Fine-tuning improves Concept Unlearning in LLMs

    Jul 4, 2026Shubhadip Nag, Srinjoy Das, Agniva Saha +5LLM Fine-TuningMachine Unlearning

  7. Harnessing non-adversarial robustness in large language models

    May 28, 2026Qinghua Zhou, Ellina Aleshina, Andrey Lovyagin +6LLM Fine-TuningNeural Network Robustness

  8. What Single-Prompt Accuracy Misses: A Multi-Variant Reliability Audit of Language Models

    May 3, 2026Ranit Karmakar, Jayita ChatterjeeLLM EvaluationLanguage Model Calibration

  9. Where Do Prompt Perturbations Break Generation? A Segment-Level View of Robustness in LoRA-Tuned Language Models

    May 2, 2026Zhuoyun Li, Boxuan Wang, Jinwei Hu +6Neural Network RobustnessNoise Robustness

  10. Flip-Flop Consistency: Unsupervised Training for Robustness to Prompt Perturbations in LLMs

    Oct 16, 2025Parsa Hejabi, Elnaz Rahmati, Alireza S. Ziabari +1Unsupervised LearningLanguage Model Robustness