Knowledge Conflicts in Language Models

Latest papers 90

All topics
CardsList
  1. The Attribution Blind Spot: Layerwise Trajectory Diagnostics for Source Reliance in Retrieval-Augmented Language Models

    Oct 7, 2026Zhe Yu, Wenpeng Xing, Yunzhao Wei +4LLM InterpretabilityRetrieval-Augmented Generation

  2. Epistemic Policy Divergence in Multi-Turn LLM Contamination: A Protocol-Gradient Investigation

    Sep 28, 2026Fahrell Giovanny, Geby Bayuningtyas, Sahrul Mukharom +1Knowledge Conflicts in Language ModelsAdversarial Attacks on LLMs

  3. Positions Are Not Facts: The Mismatch Between KV Caches and Memory

    Sep 27, 2026Changhai Zhou, Yuhua Zhou, Shiyang Zhang +5Knowledge EditingKnowledge Conflicts in Language Models

  4. Memory vs. Context? Influential Factors of Factual Recall in Language Models

    Sep 21, 2026Guilhem Fouilhé, Nicholas Asher, Philippe MullerPrompt SensitivityMemorization in Language Models

  5. CLEAR: Cross-Source Evidence Adjudication for Large Language Models in Medicine

    Sep 14, 2026Shuai Wang, Yize Zhao, Qingyu ChenRetrieval-Augmented GenerationKnowledge Conflicts in Language Models

  6. Do LLMs Make More Mistakes If They Do Not Believe the Input Data?

    Sep 8, 2026Peter Kochelka, Aleš Manuel Papáček, Vojtěch Dvořák +1LLM EvaluationKnowledge Conflicts in Language Models

  7. MeClear: Cooperative Game-Theoretic Attribution and Risk-Aware Memory Clearance for Long-Horizon LLM Agents

    Sep 8, 2026Boyu Yang, Jiazheng Sun, Zilong Lu +3Knowledge Conflicts in Language ModelsLong-Horizon LLM Agents

  8. Key Path Identification for Resolving Knowledge Conflicts via SAE-based Steering

    Sep 8, 2026Wenbo Zhang, Zhongxiang Sun, Zhiguang Han +1Language Model SteeringKnowledge Conflicts in Language Models

  9. KC-Bench: A Dynamic Interactive Benchmark for Evaluating Knowledge Conflicts in LLM Agents

    Sep 3, 2026Yaxing Lyu, Shengjie Zhou, Binbin Toh +2Knowledge Conflicts in Language ModelsLLM Agent Evaluation

  10. Large Language Models in Resolving Contextual Knowledge Conflicts

    Sep 2, 2026Xinye Yang, Zhenyang Liu, Ruisi Li +1Knowledge Conflicts in Language ModelsLLM Interpretability

  11. Context-Grounding Gains Are Mediated by Pre-existing Machinery: Auditing GRPO, SFT, and DPO

    Sep 1, 2026Prakhar Gupta, Vaibhav GuptaRL for Language ModelsLLM Grounding

  12. How Do Language Models Choose Between Context and Memory?

    Sep 1, 2026Benjamin Shih, John Winnicki, Arianna CaoKnowledge Conflicts in Language ModelsLLM Interpretability

  13. Whether LLMs Can Navigate Beliefs and Facts Depends on How You Phrase It

    Aug 18, 2026Quang Minh Nguyen, Luis Frentzen SalimKnowledge Conflicts in Language ModelsPragmatic Reasoning in Language Models

  14. When Detection Does Not Guarantee Resistance: Reasoning and Poisoned Context in RAG

    Aug 17, 2026Mehrdad Ghassabi, Audrina Ebrahimi, Sadra Hakim +3Knowledge Conflicts in Language ModelsRAG Poisoning Attacks

  15. Conflict and Congruency Effects in Large Language Models: In-Weight and In-Context Competition in a Verbal Conflict Task

    Aug 11, 2026Xiaoyang Hu, Mike Angstadt, Shane Storks +5Knowledge Conflicts in Language ModelsLLM Interpretability

  16. LatticeMind: A Conflict-Aware Memory Primitive for Multi-Agent Systems

    Aug 8, 2026Heng Zhou, Lian Zhang, Yutao Fan +5Multi-Agent LLM SystemsKnowledge Conflicts in Language Models

  17. EvoTrustRAG: Evolution-Aware Conflict Attribution and Evidence Handling for Reliable Retrieval-Augmented Generation

    Aug 8, 2026Xi Nie, Hongwei Li, Shenghao Wu +3Retrieval-Augmented GenerationKnowledge Conflicts in Language Models

  18. Learning When to Trust via Selective Context Preference Optimization

    Aug 6, 2026Xian Sun, Wei Chow, Yingshuo Wang +4Knowledge Conflicts in Language ModelsLLM Reliability

  19. PURPOSE: Poisoning Conflict Resolution in RAG via Proxy-Fact-Grounded Updates

    Aug 5, 2026Zijian Wang, Yubo Zhu, Muzhi Dong +7Knowledge Conflicts in Language ModelsRAG Poisoning Attacks

  20. Language Models Encode the Contextual Truth of Propositions

    Aug 4, 2026Rupak Sarkar, Pritika Ramu, Rachel RudingerLLM SycophancyKnowledge Conflicts in Language Models