Language Model Robustness

Latest papers 338

All topics
CardsList
  1. Competence-Preserving Resume Perturbations Expose Presentation Sensitivity in LLM Screening

    Sep 15, 2026Qiangju Chen, Yang XiaoLLM EvaluationLanguage Model Robustness

  2. Overflip: Repetition-Induced Label Flips in Guardrail Models

    Sep 14, 2026Xu He, Chih-Hsuan Lin, Hung-Mao Chen +3LLM GuardrailsAdversarial Attacks on LLMs

  3. Toward Robust Personalized Alignment for LLMs: Mitigating Persona Drift in Multi-Turn Dialogue

    Sep 14, 2026Youyuan Zhang, Siyuan Li, Fangming Liu +1Belief RevisionLLM Alignment

  4. When Noise Fabricates Bias: The Fragility of LLM-as-a-Judge Bias Measurement under Noisy Text

    Sep 10, 2026DongHyun Ryu, Jaehyeok Lee, YeongJun Hwang +1LLM-as-a-JudgeSocial Bias in Language Models

  5. Forgetting Only What Matters: Layer-Selective Unlearning toward Robust LLMs

    Sep 9, 2026Ravi Ranjan, Olivera Kotevska, Agoritsa PolyzouMemorization in Language ModelsLanguage Model Robustness

  6. Which Medical Questions Deserve Rationales? Perturbation-Sensitive Selection for Robust QA

    Sep 9, 2026Yuexin Wu, Dayou Yu, Vasile RusData SelectionMedical QA

  7. FramingQA: Does the Question Shape the Answer? Measuring the Compositional Framing Effect

    Sep 7, 2026Hazel H. Kim, Andrew M. Bean, Guilherme Affonso Ferreira de Camargo +10LLM EvaluationLLM Reliability

  8. Lost in Reordering: Structural Sensitivity of Multilingual LLMs under Semantics-Preserving Perturbations

    Sep 3, 2026Karthika Nhayakkat, Rajat Verma, Maharaj Brahma +4Numerical Reasoning in Language ModelsMultilingual Language Model Evaluation

  9. How Perturbations Propagate: A Multi-Level Analysis of Robustness in Large Language Models

    Sep 3, 2026Dun Li Chan, Emily Liu, Niyathi Allu +1Decoder-Only Language ModelsLanguage Model Robustness

  10. Untangling the Mechanisms of Misleading Context in Medical Question Answering

    Sep 2, 2026Robin Linzmayer, Noémie ElhadadMedical QALanguage Model Robustness

  11. Investigating Linear Probe Robustness to Linguistic Register, Medical Specialty, and Corpus Shifts in Medical QA

    Sep 1, 2026Nishant Mishra, Ameen Abu-Hanna, Iacer CalixtoClinical Language Model EvaluationLanguage Model Robustness

  12. Prompt-Robust Language Models: Which Training Strategies Work?

    Sep 1, 2026Frederic Sadrieh, Michal ŠtefánikPrompt SensitivityLLM Fine-Tuning

  13. Topological Steering

    Sep 1, 2026Benoît Guérand, Tan Minh NguyenLanguage Model SteeringLanguage Model Robustness

  14. Beyond Surface Forms: Symbolic Edits as a Test for Logical Reasoning with LLMs

    Aug 31, 2026Ramya Keerthy Thatikonda, Wray Buntine, Ehsan ShareghiLogical ReasoningLLM Evaluation

  15. When Do Supervised UQ Ensembles Improve LLM Hallucination Detection? A Robustness Study

    Aug 25, 2026Mohit Singh Chauhan, Vipin Gyanchandani, Dylan BouchardLLM Hallucination DetectionLLM Uncertainty Estimation

  16. When Detection Does Not Guarantee Resistance: Reasoning and Poisoned Context in RAG

    Aug 17, 2026Mehrdad Ghassabi, Audrina Ebrahimi, Sadra Hakim +3Knowledge Conflicts in Language ModelsRAG Poisoning Attacks

  17. Jagged Judges: Epistemic Stability Under Silence, Pressure, and Persistence

    Aug 12, 2026Justin Zhao, Himaghna Bhattacharjee, Hannah Korevaar +2LLM EvaluationLLM-as-a-Judge

  18. Policy-as-logic for robust reasoning over rules

    Aug 12, 2026Rahul Nair, Bastian Lipka, Elizabeth DalyNeuro-Symbolic ReasoningLanguage Model Robustness

  19. The Wording Effect: Quantifying Two-Way Drift in LLM Benchmark Performance

    Aug 12, 2026Shailja Thakur, Sungeun An, Chad DeLuca +1Prompt SensitivityLLM Evaluation

  20. Assessing Reliability of BERT-Based Models on Question Answering Tasks

    Aug 11, 2026Pooja Yadav, Priyanka Harjule, Basant Agarwal +1Question AnsweringLanguage Model Robustness

  21. MD-ProTector: Positioning Multiple Data-Driven Prototypes for LLM-Generated Text Detection

    Aug 11, 2026Jinmo Han, Jimin Hong, Chanyeong Moon +3AI-Generated Text DetectionPrototype Learning