Prompt Sensitivity

Momentum

9 papers in the last four weeks, down 10% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 68

All topics
CardsList
  1. As Easy as Rocket Science: Assessing the Ability of Large Language Models to Interpret Negation in Figurative Language

    Jun 17, 2026Jasmine Owers, Edwin Simpson, Martha LewisFigurative Language UnderstandingPrompt Sensitivity

  2. Demystifying Variance in Circuit Discovery of LLMs

    Jun 15, 2026Frank Zhengqing Wu, Francesco Tonin, Volkan CevherPrompt SensitivityCircuit Discovery

  3. Discourse-Role Labels as Presentation-Time Variables for Context Use in Language Models

    Jun 2, 2026Jianguo Zhu, Xiangmei Li, Wenjie LiuPrompt SensitivityLLM Evaluation

  4. The Invisible Lottery: How Subtle Cues Steer Algorithm Choice in LLM Code Generation

    Jun 2, 2026Akanksha Narula, Mofasshara Binte Rafique, Laurent BindschaedlerPrompt SensitivityLLM Prompting

  5. The Unsampled Truth: Quantifying Prompt Artifacts in LM Psychometrics

    Jun 2, 2026Nils Schwager, Christoph Hau, Simon Münker +1Prompt SensitivityLLM Prompting

  6. Lingo_Research_Group at SemEval-2026 Task 9: Evaluating Prompt Variants for Polarization Detection

    Jun 2, 2026Pritam Kadasi, Anuj Tiwari, Mayank SinghPrompt SensitivityText Classification

  7. Toxic HallucinAItions: Perturbing Prompts and Tracing LLM Circuits

    May 29, 2026Soorya Ram Shimgekar, Agam Goyal, Amruta Parulekar +6Prompt SensitivityLLM Interpretability

  8. Same Patient, Different Words, Different Diagnosis? Evaluating Semantic Stability in Clinical LLMs

    May 28, 2026Mahdi Alkaeed, Adnan Qayyum, Nabeel Abo Kashreef +2Prompt SensitivityClinical Language Model Evaluation

  9. Minimal Prompt Perturbations Lead to Code Vulnerabilities: Prompt Fragility and Hidden-State Signals in Coding LLMs

    May 28, 2026Alexander Sternfeld, Andrei Kucharavy, Ljiljana DolamicPrompt SensitivityAdversarial Attacks on LLMs

  10. Spurious Prompts: Can Irrelevant Prompts Steer Large Language Models?

    May 28, 2026Pawel Batorski, Abtin Pourhadi, Jerzy Sarosiek +2Prompt SensitivityLLM Prompting

  11. PromptAudit: Auditing Prompt Sensitivity in LLM-Based Vulnerability Detection

    May 22, 2026Steffen J. Camarato, Yahya Hmaiti, Mandana Ghadamian +1Prompt SensitivityLLM Auditing

  12. Medical Context Distorts Decisions in Clinical Vision Language Models

    May 17, 2026David Restrepo, Ira Ktena, Maria Vakalopoulou +2VLM EvaluationVLM Robustness

  13. Targeted Tests for LLM Reasoning: An Audit-Constrained Protocol

    May 12, 2026Hongmin LiPrompt SensitivityLanguage Model Robustness

  14. BiAxisAudit: A Novel Framework to Evaluate LLM Bias Across Prompt Sensitivity and Response-Layer Divergence

    May 9, 2026Jialing Gan, Junhao Dong, Songze LiPrompt SensitivityLLM Auditing

  15. Impact of Task Phrasing on Presumptions in Large Language Models

    May 1, 2026Kenneth J. K. OngPrompt SensitivityLLM Prompting

  16. Prompt-Induced Score Variance in Zero-Shot Binary Vision-Language Safety Classification

    May 1, 2026Charles Weng, Dingwen Li, Alexander MartinVLM EvaluationZero-Shot Learning

  17. Green Shielding: A User-Centric Approach Towards Trustworthy AI

    Apr 27, 2026Aaron J. Li, Nicolas Sanchez, Hao Huang +8Prompt SensitivityClinical Language Model Evaluation

  18. Reliability Auditing for Downstream LLM tasks in Psychiatry: LLM-Generated Hospitalization Risk Scores

    Apr 23, 2026Shevya Panda, Shinjini Bose, Ananya JoshiPrompt SensitivityLLM Auditing

  19. Shared Lexical Task Representations Explain Behavioral Variability In LLMs

    Apr 23, 2026Zhuonan Yang, Jacob Xiaochen Li, Francisco Piedrahita Velez +5Prompt SensitivityLLM Prompting

  20. Understanding the Prompt Sensitivity

    Apr 20, 2026Yang Liu, Chenhui ChuPrompt SensitivityLLM Prompting