Language Model Robustness

Latest papers 338

All topics
CardsList
  1. MGTEVAL: An Interactive Platform for Systemtic Evaluation of Machine-Generated Text Detectors

    Apr 28, 2026Yuanfan Li, Qi Zhou, Chengzhengxu Li +5AI-Generated Text DetectionLanguage Model Generation Evaluation

  2. MultiHedge: Adaptive Coordination via Retrieval-Augmented Control

    Apr 27, 2026Feliks Bańka, Jarosław A. ChudziakRetrieval-Augmented GenerationLLM Decision-Making

  3. Defective Task Descriptions in LLM-Based Code Generation: Detection and Analysis

    Apr 27, 2026Amal Akli, Mike Papadakis, Maxime Cordy +1Code Generation EvaluationLanguage Model Robustness

  4. Green Shielding: A User-Centric Approach Towards Trustworthy AI

    Apr 27, 2026Aaron J. Li, Nicolas Sanchez, Hao Huang +8Prompt SensitivityClinical Language Model Evaluation

  5. OS-SPEAR: A Toolkit for the Safety, Performance,Efficiency, and Robustness Analysis of OS Agents

    Apr 27, 2026Zheng Wu, Yi Hua, Zhaoyuan Huang +8Computer-Use AgentsAI Agent Evaluation

  6. An Information-Geometric Framework for Stability Analysis of Large Language Models under Entropic Stress

    Apr 27, 2026Hikmat Karimov, Rahid Zahid AlekberliLLM EvaluationLLM Reliability

  7. Agentic Adversarial Rewriting Exposes Architectural Vulnerabilities in Black-Box NLP Pipelines

    Apr 26, 2026Mazal Bethany, Kim-Kwang Raymond Choo, Nishant Vishwamitra +1Fake News DetectionAdversarial Prompt Generation

  8. CAP-CoT: Cycle Adversarial Prompt for Improving Chain of Thoughts in LLM Reasoning

    Apr 25, 2026Shuxu Chen, Yitian Zhou, Jiaquan Zhang +6Adversarial Prompt GenerationLLM Prompting

  9. Characterizing Paraphrase-Induced Failures in Lean 4 Autoformalization

    Apr 25, 2026William Feng, Ethan Lou, Aryan SharmaLean Theorem ProvingCode Generation Evaluation

  10. Revisiting Non-Verbatim Memorization in Large Language Models: The Role of Entity Surface Forms

    Apr 23, 2026Yuto Nishida, Naoki Shikoda, Yosuke Kishinami +4LLM EvaluationMemorization in Language Models

  11. When Correct Beliefs Collapse: Epistemic Resilience of LLMs under Clinical Pressure

    Apr 23, 2026Boyu Xiao, Xiuqi Tian, Xuwen Song +4LLM SycophancyHealthcare

  12. LayerTracer: A Joint Task-Particle and Vulnerable-Layer Analysis framework for Arbitrary Large Language Model Architectures

    Apr 22, 2026Yuhang Wu, Qinyuan Liu, Qiuyang Zhao +1LLM InterpretabilityLanguage Model Robustness

  13. HoWToBench: Holistic Evaluation for LLM's Capability in Human-level Writing using Tree of Writing

    Apr 21, 2026Andrew Zhuoer Feng, Cunxiang Wang, Yu Luo +7LLM EvaluationLLM-as-a-Judge

  14. Experiments or Outcomes? Probing Scientific Feasibility in Large Language Models

    Apr 20, 2026Seyedali Mohammadi, Manas Gaur, Francis FerraroLLM EvaluationScientific Reasoning in Language Models

  15. Adversarial Humanities Benchmark: Results on Stylistic Robustness in Frontier Model Safety

    Apr 20, 2026Marcello Galisai, Susanna Cifani, Francesco Giarrusso +5LLM Safety BenchmarksAdversarial Attacks on LLMs

  16. Understanding the Prompt Sensitivity

    Apr 20, 2026Yang Liu, Chenhui ChuPrompt SensitivityLLM Prompting

  17. Measuring Distribution Shift in User Prompts and Its Effects on LLM Performance

    Apr 19, 2026Parker Seegmiller, Sarah Masud PreumLLM EvaluationInstruction Following

  18. Recurrent Reasoning on Symbolic Puzzles with Sequence Models

    Apr 19, 2026Gowrav Mannem, Chowdhury Marzia Mahjabin, Jason Chen +2Symbolic PlanningSymbolic Reasoning

  19. Still Between Us? Evaluating and Improving Voice Assistant Robustness to Third-Party Interruptions

    Apr 19, 2026Dongwook Lee, Eunwoo Song, Che Hyun Lee +2Spoken Dialogue SystemsAudio Understanding

  20. No-Worse Context-Aware Decoding: Preventing Neutral Regression in Context-Conditioned Generation

    Apr 17, 2026Yufei Tao, Ameeta AgrawalLanguage Model DecodingLLM Reliability

  21. No Universal Courtesy: A Cross-Linguistic, Multi-Model Study of Politeness Effects on LLMs Using the PLUM Corpus

    Apr 17, 2026Hitesh Mehta, Arjit Saxena, Garima Chhikara +1Multilingual Language Model EvaluationLLM Evaluation

  22. Beyond Surface Statistics: Robust Conformal Prediction for LLMs via Internal Representations

    Apr 17, 2026Yanli Wang, Peng Kuang, Xiaoyu Han +2Confidence Estimation in Language ModelsConformal Prediction

  23. On the Robustness of LLM-Based Dense Retrievers: A Systematic Analysis of Generalizability and Stability

    Apr 17, 2026Yongkang Li, Panagiotis Eustratiadis, Yixing Fan +1LLM EvaluationRetrieval Robustness

  24. A Systematic Study of Training-Free Methods for Trustworthy Large Language Models

    Apr 17, 2026Wai Man Si, Mingjie Li, Michael Backes +1LLM AlignmentLLM Safety

  25. Consistency Analysis of Sentiment Predictions using Syntactic & Semantic Context Assessment Summarization (SSAS)

    Apr 16, 2026Sharookh Daruwalla, Nitin Mayande, Shreeya Verma Kathuria +2Sentiment AnalysisLanguage Model Robustness

  26. Pushing the Boundaries of Multiple Choice Evaluation to One Hundred Options

    Apr 16, 2026Nahyun Lee, Guijin SonLLM EvaluationMultiple-Choice Question Answering