Language Model Robustness

Latest papers 338

All topics
CardsList
  1. Absurd World: A Simple Yet Powerful Method to Absurdify the Real-world for Probing LLM Reasoning Capabilities

    May 10, 2026Ryan Albright, Golam Md Muktadir, Zarif Ikram +3LLM EvaluationLanguage Model Robustness

  2. Can We Trust LLMs for Mental Health Screening? Consistency, ASR Robustness, and Evidence Faithfulness

    May 10, 2026Erfan Loweimi, Sofia de la Fuente Garcia, Samira Loveymi +2HealthcareMental Health

  3. How LLMs Are Persuaded: A Few Attention Heads, Rerouted

    May 10, 2026Xiangkun Sun, Lingkai Kong, Aoqi Zhang +2Self-AttentionLLM Interpretability

  4. WASIL: In-the-Wild Arabic Spoken Interactions with LLMs

    May 9, 2026Zien Sheikh Ali, Hamdy Mubarak, Soon-Gyo Jung +3Voice Agent EvaluationArabic NLP

  5. FragileFlow: Spectral Control of Correct-but-Fragile Predictions for Foundation Model Robustness

    May 9, 2026Zhuoyun Li, Boxuan Wang, Jinwei Hu +2VLM RobustnessSpectral Regularization

  6. DiagnosticIQ: A Benchmark for LLM-Based Industrial Maintenance Action Recommendation from Symbolic Rules

    May 9, 2026Devin Yasith De Silva, Dhaval Patel, Christodoulos Constantinides +7Logical ReasoningLLM Evaluation

  7. Coordinates of Capability: A Unified MTMM-Geometric Framework for LLM Evaluation

    May 8, 2026Adib Sakhawat, Tahsin Islam, Takia Farhin +3LLM EvaluationLanguage Model Robustness

  8. Can Language Models Identify Side Effects of Breast Cancer Radiation Treatments?

    May 8, 2026Natalie Seah, Danielle S. Bitterman, Daphna Spiegel +1Breast CancerHealthcare

  9. The Text Uncanny Valley: Non-Monotonic Performance Degradation in LLM Information Retrieval

    May 8, 2026Zekai Tong, Ruiyao Xu, Aryan Shrivastava +2LLM EvaluationLLM Reliability

  10. Can LLMs Take Retrieved Information with a Grain of Salt?

    May 7, 2026Behzad Shayegh, Mohamed Osama Ahmed, Fred Tung +1Retrieval-Augmented GenerationLLM Evaluation

  11. Preference Instability in Reward Models: Detection and Mitigation via Sparse Autoencoders

    May 7, 2026Shunchang Liu, Xin Chen, Belen Martin Urcelay +1Reward ModelingSparse Autoencoders

  12. Towards Emotion Consistency Analysis of Large Language Models in Emotional Conversational Contexts

    May 7, 2026Sneha Oram, Ojaswita Bhushan, Pushpak BhattacharyyaLLM EvaluationLanguage Model Robustness

  13. Information Theoretic Adversarial Training of Large Language Models

    May 6, 2026Yiwei Zhang, Jeremiah Birrell, Reza Ebrahimi +3Adversarial TrainingLLM Alignment

  14. TriBench-Ko: Evaluating LLM Risks in Judicial Workflows

    May 5, 2026Haesung Lee, Gyubin Choi, Eun-Ju Lee +5LLM EvaluationLanguage Model Safety Evaluation

  15. Stop Automating Peer Review Without Rigorous Evaluation

    May 4, 2026Joachim Baumann, Jiaxin Pei, Sanmi Koyejo +1LLM-as-a-JudgeScholarly Peer Review

  16. Evaluating Reasoning Models for Queries with Presuppositions

    May 4, 2026Rose Sathyanathan, Kinshuk Vasisht, Danish PruthiLLM EvaluationLanguage Model Robustness

  17. What Single-Prompt Accuracy Misses: A Multi-Variant Reliability Audit of Language Models

    May 3, 2026Ranit Karmakar, Jayita ChatterjeeLLM EvaluationLanguage Model Calibration

  18. Where Do Prompt Perturbations Break Generation? A Segment-Level View of Robustness in LoRA-Tuned Language Models

    May 2, 2026Zhuoyun Li, Boxuan Wang, Jinwei Hu +6Neural Network RobustnessNoise Robustness

  19. Lost in the Tower of Babel: The Adverse Effects of Incidental Multilingualism in LLMs

    May 2, 2026Anjishnu Mukherjee, Chutong Meng, Antonios AnastasopoulosMultilingual Language ModelsMultilingual Language Model Evaluation

  20. When Embedding-Based Defenses Fail: Rethinking Safety in LLM-Based Multi-Agent Systems

    May 1, 2026Lingxi Zhang, Guangtao Zheng, Hanjie ChenAdversarial AttacksLanguage Model Robustness

  21. CLEAR: Revealing How Noise and Ambiguity Degrade Reliability in LLMs for Medicine

    May 1, 2026Kevin H. Guo, Chao Yan, Avinash Baidya +5HealthcareLLM Reliability

  22. Are Tools All We Need? Unveiling the Tool-Use Tax in LLM Agents

    Apr 30, 2026Kaituo Zhang, Zhen Xiong, Mingyu Zhong +4Tool-Augmented Language Model AgentsAgentic Reasoning

  23. A Reproducibility Analysis of PO4ISR: Diagnosing and Mitigating Semantic Drift in LLM-Based Session Recommendation

    Apr 29, 2026Aditya Tiwari, Konduri Naga Lakshmi Rekha, Rajesh Kumar MundotiyaSequential RecommendationLLM Prompting