Language Model Robustness

Latest papers 338

All topics
CardsList
  1. Code Monitor Red Teaming for Public-Test-Passing Code

    Jul 23, 2026Junchi Liao, Jiawen Deng, Fuji RenLLM AuditingCode Generation Evaluation

  2. Understanding the Impact of Linguistic Realization Choices on LLM Stance with Causal Tracing

    Jul 22, 2026Langchen Huang, Sebastian Padó, Franziska WeeberPrompt SensitivityLLM Interpretability

  3. It's Not What You Say, It's How You Say It: Evaluating LLM Responses to Expressions of Belief

    Jul 20, 2026Kevin Du, Clara Kümpel, Michelle Wastl +1LLM EvaluationKnowledge Conflicts in Language Models

  4. StabilityBench: Benchmarking Instability in LLMs

    Jul 17, 2026Emma Kondrup, Zachary Yang, Anne Imouza +1LLM EvaluationLanguage Model Generation Evaluation

  5. Conditional Reliability of Toxicity Signals for Multilingual and Code-Mixed Abuse Detection

    Jul 17, 2026Indraveni Chebolu, Rohan Singh, Arnab Mallick +1Multilingual Language Model EvaluationHate Speech Detection

  6. Show Me How You Reason and I'll Tell You Who You Are: Reasoning Graphs for Robust LLM Authorship Attribution

    Jul 16, 2026Zlata Kikteva, Artur Romazanov, Annette Hautli-Janisz +1AI-Generated Text DetectionAuthorship Attribution

  7. Implicit Reasoning Steering via Concept Chaining

    Jul 15, 2026Xiao Ye, Sanika Chavan, Yuxi Huang +4Adversarial Attacks on LLMsReasoning Consistency in Language Models

  8. Quantize with Confidence? An Empirical Study of Quantization for Code Generation

    Jul 15, 2026Saima Afrin, Md. Zahidul Haque, Antonio MastropaoloLLM QuantizationCode Generation Evaluation

  9. GSM-Plus-BN: A Perturbation-Based Benchmark for Bangla Mathematical Reasoning in Large Language Models

    Jul 14, 2026Bidyarthi Paul, Nahida Jannat Mayouree, Md. Asif Karim +2Mathematical Reasoning BenchmarksMultilingual Language Model Evaluation

  10. Reliability Scaling Laws for Quantized Large Language Models

    Jul 12, 2026Sirine Ayadi, Sándor Daróczi, Stephan Günnemann +1LLM QuantizationLanguage Model Calibration

  11. Mitigating LLM Sycophancy in Code Smell Detection Using Evidence-Guided Reasoning Prompts

    Jul 11, 2026Istiaq Ahmed Fahad, Kamruzzaman Asif, Md. Nurul Ahad TawhidLLM SycophancyStatic Code Analysis

  12. DiaLLM: An Investigation into the Robustness-Generation Gap in English Dialect Adaptation

    Jul 8, 2026Jordan Painter, Dipankar Srirag, Adarsh Kappiyath +3Language Model PretrainingLLM Alignment

  13. Prompt Robustness Is Task-Dependent: Comparing Objective and Belief-Style Questions in LLM Evaluation

    Jul 6, 2026Sadia Kamal, Arefa Patwary, Anthony Marchiafava +2LLM EvaluationLanguage Model Generation Evaluation

  14. Obey, Diverge, Collapse: Blind Obedience to Incorrect Instructions Drives Code LLMs to Irrecoverable Code Semantic Collapse

    Jul 5, 2026Raj Jaiswal, Anany Singh Divy, Savar Bhasin +3LLM Self-CorrectionAutomated Program Repair

  15. Do LLMs Truly Generalize in the Molecular Domain? A Perturbation-Based Analysis

    Jul 2, 2026Jiatong Li, Weida Wang, Changmeng Zheng +4In-Context LearningMolecular Property Prediction

  16. Addressing Over-Refusal in LLMs with Competing Rewards

    Jun 30, 2026Taeyoun Kim, Aviral KumarRL for Language Model ReasoningLLM Safety

  17. Moral Safety in LLMs: Exposing Performative Compliance with Puzzled Cues

    Jun 30, 2026Mohammadamin Shafiei, Shuyue Stella Li, Yulia TsvetkovLanguage Model Safety EvaluationLanguage Model Bias Evaluation

  18. Truth or Sophistry? LoFa: A Benchmark for LLM Robustness Against Logical Fallacies

    Jun 30, 2026Xudong Shen, Li Yuan, Ye Chen +3LLM EvaluationAdversarial Attacks on LLMs