Language Model Robustness

Latest papers 338

All topics
CardsList
  1. The First Drop of Ink: Nonlinear Impact of Misleading Information in Long-Context Reasoning

    May 11, 2026Muhan Gao, Zih-Ching Chen, Kuan-Hao HuangLong-Context InferenceLanguage Model Robustness

  2. How Should LLMs Listen While Speaking? A Study of User-Stream Routing in Full-Duplex Spoken Dialogue

    May 11, 2026Hui Lu, Xueyuan Chen, Huimeng Wang +4Language Model RobustnessFull-Duplex Spoken Dialogue Systems

  3. Synthetic Pre-Pre-Training Improves Language Model Robustness to Noisy Pre-Training Data

    May 11, 2026Xu Guo, Runyu Peng, Jian Tong +4Language Model PretrainingSynthetic Data Pretraining

  4. Absurd World: A Simple Yet Powerful Method to Absurdify the Real-world for Probing LLM Reasoning Capabilities

    May 10, 2026Ryan Albright, Golam Md Muktadir, Zarif Ikram +3LLM EvaluationLanguage Model Robustness

  5. Can We Trust LLMs for Mental Health Screening? Consistency, ASR Robustness, and Evidence Faithfulness

    May 10, 2026Erfan Loweimi, Sofia de la Fuente Garcia, Samira Loveymi +2HealthcareMental Health

  6. How LLMs Are Persuaded: A Few Attention Heads, Rerouted

    May 10, 2026Xiangkun Sun, Lingkai Kong, Aoqi Zhang +2Self-AttentionLLM Interpretability

  7. WASIL: In-the-Wild Arabic Spoken Interactions with LLMs

    May 9, 2026Zien Sheikh Ali, Hamdy Mubarak, Soon-Gyo Jung +3Voice Agent EvaluationArabic NLP

  8. FragileFlow: Spectral Control of Correct-but-Fragile Predictions for Foundation Model Robustness

    May 9, 2026Zhuoyun Li, Boxuan Wang, Jinwei Hu +2VLM RobustnessSpectral Regularization

  9. DiagnosticIQ: A Benchmark for LLM-Based Industrial Maintenance Action Recommendation from Symbolic Rules

    May 9, 2026Devin Yasith De Silva, Dhaval Patel, Christodoulos Constantinides +7Logical ReasoningLLM Evaluation

  10. Coordinates of Capability: A Unified MTMM-Geometric Framework for LLM Evaluation

    May 8, 2026Adib Sakhawat, Tahsin Islam, Takia Farhin +3LLM EvaluationLanguage Model Robustness

  11. Can Language Models Identify Side Effects of Breast Cancer Radiation Treatments?

    May 8, 2026Natalie Seah, Danielle S. Bitterman, Daphna Spiegel +1Breast CancerHealthcare

  12. The Text Uncanny Valley: Non-Monotonic Performance Degradation in LLM Information Retrieval

    May 8, 2026Zekai Tong, Ruiyao Xu, Aryan Shrivastava +2LLM EvaluationLLM Reliability

  13. Can LLMs Take Retrieved Information with a Grain of Salt?

    May 7, 2026Behzad Shayegh, Mohamed Osama Ahmed, Fred Tung +1Retrieval-Augmented GenerationLLM Evaluation

  14. Preference Instability in Reward Models: Detection and Mitigation via Sparse Autoencoders

    May 7, 2026Shunchang Liu, Xin Chen, Belen Martin Urcelay +1Reward ModelingSparse Autoencoders

  15. Towards Emotion Consistency Analysis of Large Language Models in Emotional Conversational Contexts

    May 7, 2026Sneha Oram, Ojaswita Bhushan, Pushpak BhattacharyyaLLM EvaluationLanguage Model Robustness

  16. Information Theoretic Adversarial Training of Large Language Models

    May 6, 2026Yiwei Zhang, Jeremiah Birrell, Reza Ebrahimi +3Adversarial TrainingLLM Alignment

  17. TriBench-Ko: Evaluating LLM Risks in Judicial Workflows

    May 5, 2026Haesung Lee, Gyubin Choi, Eun-Ju Lee +5LLM EvaluationLanguage Model Safety Evaluation

  18. Stop Automating Peer Review Without Rigorous Evaluation

    May 4, 2026Joachim Baumann, Jiaxin Pei, Sanmi Koyejo +1LLM-as-a-JudgeScholarly Peer Review

  19. Evaluating Reasoning Models for Queries with Presuppositions

    May 4, 2026Rose Sathyanathan, Kinshuk Vasisht, Danish PruthiLLM EvaluationLanguage Model Robustness

  20. What Single-Prompt Accuracy Misses: A Multi-Variant Reliability Audit of Language Models

    May 3, 2026Ranit Karmakar, Jayita ChatterjeeLLM EvaluationLanguage Model Calibration

  21. Where Do Prompt Perturbations Break Generation? A Segment-Level View of Robustness in LoRA-Tuned Language Models

    May 2, 2026Zhuoyun Li, Boxuan Wang, Jinwei Hu +6Neural Network RobustnessNoise Robustness

  22. Lost in the Tower of Babel: The Adverse Effects of Incidental Multilingualism in LLMs

    May 2, 2026Anjishnu Mukherjee, Chutong Meng, Antonios AnastasopoulosMultilingual Language ModelsMultilingual Language Model Evaluation

  23. When Embedding-Based Defenses Fail: Rethinking Safety in LLM-Based Multi-Agent Systems

    May 1, 2026Lingxi Zhang, Guangtao Zheng, Hanjie ChenAdversarial AttacksLanguage Model Robustness

  24. CLEAR: Revealing How Noise and Ambiguity Degrade Reliability in LLMs for Medicine

    May 1, 2026Kevin H. Guo, Chao Yan, Avinash Baidya +5HealthcareLLM Reliability