Large Language Models Fail

Latest papers 249

All topics
CardsList
  1. How Do LLMs Change Predictions Under Negation?

    Oct 7, 2026Jongwook Yoon, Jongwon Lim, Sungjib Lim +2Large Language Models Fail

  2. Large language models are vulnerable to incidental information in clinical documentation and reasoning

    Oct 6, 2026Krithik Vishwanath, Brandon Ye, Anton Alyakin +4Large Language Models Fail

  3. Mind the Gaps: From Failure Attribution to Closed-Form Repair of Code Language Models

    Oct 4, 2026Jian Gu, Hongyu Zhang, Chunyang Chen +1Large Language Models Fail

  4. When Context Changes: Understanding Update Failures in LLMs

    Sep 30, 2026Junyu Guo, Yuchen Fang, Shangding Gu +3Large Language Models FailGradient Staleness

  5. Where MLLMs Fail and Why: Causal Task Decomposition for Capability Failure Diagnosis

    Sep 30, 2026Xia Hu, Brian Potetz, Chun-Ta Lu +6Large Language Models FailLatent Failure Patterns

  6. SemOPT: Fixing Semantic Errors in LLM-based Optimization Modeling via Reward-Guided Search

    Sep 29, 2026Zetong Zhou, Wentao Zhang, Jingyuan Wang +3Optimization ModelingFunctional Code Solvers

  7. When Capabilities Fail to Compose: Diagnosing the Compositionality Gap in Large Audio-Language Models

    Sep 29, 2026Chien-Feng Liu, Chih-Kai Yang, Bo-Han Feng +3Large Audio Language ModelsLarge Language Models Fail

  8. VAA-CSEC: Vote-guided Advantage Allocation for Chinese Semantic Error Correction

    Sep 29, 2026Yitong Han, Nankai Lin, Juan Luo +3Grammatical Error CorrectionCorrection

  9. Tool Mediation Alters Refusal Mechanisms in Large Language Models

    Sep 28, 2026Abel Rodríguez, Giuseppe Garofalo, Lieven Desmet +1Large Language Models FailRefusals

  10. A mechanistic study of language model introspection

    Sep 28, 2026Jiahong Zou, Xiangkun Sun, Lingkai Kong +1Introspection AdaptersLarge Language Models Fail

  11. See it, Say it, Sorted: Mechanistic Diagnosis and Parameter-Space Mitigation of Emergent Misalignment in LLMs

    Sep 28, 2026Weiqiao Que, Ruizhe Li, Chengyu Wang +3Large Language Model SafetyEmergent Misalignment

  12. LLMs are not stochastic parrots: Evidence for meaning-mediated abstraction from conlang-like tasks

    Sep 28, 2026Julia Witte Zimmerman, Calla G. Beauregard, Tabia Tanzin Prama +3Large Language Models FailHypothesis

  13. Large Language Models for Programming: Actually Fixing or Reimplementing Incorrect Code?

    Sep 24, 2026Alexandru Stefan Stoica, Traian Rebedea, Marian Cristian MihaescuAi-Assisted Programming TasksLarge Language Models Fail

  14. WiC is Not WSD: A Study on LLMs and Lexical Ambiguity Resolution

    Sep 17, 2026Yi Zhou, Kiamehr Rezaee, Danushka Bollegala +2DisambiguationLarge Language Models Fail

  15. Beyond Accuracy: How Procedural Traces Shift the Decision Criterion of LLM Overseers

    Sep 16, 2026Zihan Chen, Di Zhu, Lei Zheng +1Model AuditingLarge Language Models Fail

  16. ToMAS: A Pilot Failure-Grounded Theory-of-Mind Benchmark from Multi-Agent LLM Failures

    Sep 15, 2026Muhammad Ashar Ishfaq, Glaucia MeloMulti-Agent Large Language Model SystemsLarge Language Models Fail

  17. Psychosis involves a deficit of information compression in connected speech

    Sep 14, 2026Samuele Vallisa, Claudio Palominos, Rui He +6LinguisticsSurprisal

  18. Overflip: Repetition-Induced Label Flips in Guardrail Models

    Sep 14, 2026Xu He, Chih-Hsuan Lin, Hung-Mao Chen +3FlipsGuardrail

  19. Semantic Fibers and Cross-Gram Interference: A Calculus of Safety Drift in Overcomplete Representations

    Sep 14, 2026Mohammed Ahnouch, Lotfi ElaachackMultilingual SafetyRepresentation-Level Misalignment

  20. Translation Indeterminacy and the Distributional Fallacy

    Sep 7, 2026Michael CarlCross-Lingual ConsistencyLarge Language Models Fail

  21. DCFA: Dual-view Causal-inspired Attribution for Failure Reasoning in LLM-based Multi-agent Systems

    Sep 7, 2026Zehao Wang, Lanjun Wang, Shilong Jin +2Large Language Models FailLatent Failure Patterns

  22. Mitigating LLM Over-Refusal via Dynamic Semantic Routing Calibration

    Sep 6, 2026Zixuan Wang, Bingjie Zhang, He Zhao +1Large Language Model SafetyRefusals

  23. Better Understanding, Better Fixes? A Study of Hallucination in LLM-based Automated Program Repair

    Sep 4, 2026Xuemeng Cai, Jiakun Liu, Linhan Yang +2Automated Program RepairRepair

  24. Lost in Reordering: Structural Sensitivity of Multilingual LLMs under Semantics-Preserving Perturbations

    Sep 3, 2026Karthika Nhayakkat, Rajat Verma, Maharaj Brahma +4Large Language Models FailConceptual Reorganization

  25. No country for old linguists: LLM-brain alignment underdetermines neural computation

    Sep 2, 2026Elliot MurphyLarge Language Model AlignmentArtificial Intelligence Alignment

  26. The Dynamics of Continuous Mixture Collapse in Language Models

    Sep 2, 2026Ali BackourLarge Language Models FailLatent States

  27. Knowing Is Not Enough: Information Retrievability as a Precondition to Effective LLM Oversight

    Sep 2, 2026Xinyu Fu, Narayan Ramasubbu, Dennis GallettaLarge Language Models FailExplainable AI Methods

  28. Predicting Program Exit Code with LLMs and Programming Language Semantics

    Sep 1, 2026Lara Marinov, Aditya Thimmaiah, Jayanth Srinivasa +2Large Language Models FailPretraining

  29. When Errors Become Memories: Causal Pathway Tracing in Multi-Turn Memory-Augmented LLMs

    Aug 31, 2026Shuyao Xiao, Shengling Wang, Xuan Chen +8Large Language Model MemoryLarge Language Models Fail

  30. When Less is More: Understanding When Token Filtering Helps and Fails in AI-generated Text Detection

    Aug 30, 2026Xiaoyang Han, Lvxiaowei Xu, Ming CaiMachine-Generated Text DetectionLarge Language Models Fail

  31. Hidden in the Request: Explaining Unethical LLM Compliance through Token Relevance

    Aug 24, 2026Or Biton, Tomer Krichli, Itai Allouche +1Large Language Models Fail

  32. Falsehood and Impossibility Are Different Directions in an AI's Representation of Language

    Aug 13, 2026Yoon Pyo LeeImpossibilityFalsehood

  33. Pragmatic Attack Surface: Vulnerabilities of Implicit Context in Large Language Models

    Aug 10, 2026Bocheng Chen, Han Zi, Roucheng Ou +5Large Language Models FailSafety Alignment

  34. Failure-Aware Long-Form Translation: Design and Implementation of a Recoverable LLM Translation System

    Aug 10, 2026Yanlin YuTranslation QualityLarge Language Models Fail

  35. Harmful Content Is Not Enough: Continuation Framing Moderates In-Context Emergent Misalignment

    Aug 8, 2026Peiyang Liu, Xi Wang, Ziqiang Cui +2Emergent MisalignmentHarmful Content

  36. Mood Matters: How Syntactic Sensitivity Undermines Safety Alignment

    Aug 5, 2026Alina Klerings, Jannik Brinkmann, Heiner Stuckenschmidt +1Safety AlignmentLarge Language Model Alignment

  37. Recovering Lesion Parameters from Aphasic Picture Naming Error Profiles in Large Language Models

    Aug 5, 2026Yong Yang, Roger Newman-Norlund, Xiang Guan +10Large Language Models FailDysarthric Speech

  38. Sharding Prevents LLM Oversight Failures and Adversarial Exploitation

    Aug 5, 2026Victor Akinwande, J. Zico Kolter, Aran NayebiJudgesScalable Oversight

  39. Don't Let Me Ask for It: LLMs Show Deficiencies in Active Multi-Turn Information Acquisition for Abductive Inference

    Aug 4, 2026Shahrukh Mohiuddin, Chalamalasetti Kranti, Sherzod Hakimov +1Abductive ReasoningLarge Language Models Fail

  40. Why Large Language Models Fail at Tabular Prediction

    Aug 3, 2026Marta Garnelo, Wojciech M. CzarneckiLarge Language Models FailTabular Data

  41. Position: It's Time to Optimize LLMs for Self-Consistency

    Jul 31, 2026Itamar Pres, Belinda Z. Li, Laura Ruis +6Large Language Models FailSelf-Consistency

  42. Reflection or Re-Generation? Why LLM Revision Fails Where Human Revision Succeeds

    Jul 31, 2026Yefan Tao, Gerald Friedland, Madhusudhanan Chandrasekaran +1ReflectionsLarge Language Models Fail

  43. To Add Is Machine, To Delete Is Human: Measuring and Mitigating Deletion Avoidance in LLM Code Editing

    Jul 30, 2026Amir M. Ebrahimi, Mohammed Mehedi Hasan, Aaditya Bhatia +2Code QualityDeletion