Evidence Conflict

Momentum

7 papers in the last four weeks, up 133% on the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 39

All topics
CardsList
  1. When Do Biological Reasoning Models Use Their Biological Inputs?

    Oct 1, 2026Ada Fang, Nikitha Thoduguli, Lukas Fesser +3Evidence ConflictFoundation Model

  2. Can LLMs Value the Right Evidence? Evidence-Value Misalignment in Dynamic Medical Diagnosis

    Sep 28, 2026Kehua Feng, Yunsheng Lu, Yitong Qiao +5DiagnosisEvidence Conflict

  3. ReSync: Re-Aligning the Two Clocks of Asynchronous World-Action Models

    Sep 27, 2026Xi Lin, Feihong Zhang, Yulong Shi +6Recent World-Action ModelsWorld Models

  4. ARAFA: An LLM-Generated Arabic Fact-Checking Dataset

    Sep 22, 2026Christophe Khalil, Shady Elbassuoni, Rida AssafArabicArabic Natural Language Processing

  5. GroundedGEO: Auditing the Evidence Gap in Generative Search Rankings

    Sep 21, 2026Yihan Xia, Huiling Fan, Kangrong Zhong +1Evidence-Grounded QuestionsEvidence Conflict

  6. Look Where It Counts: A Free, Label-Free Visual Evidence Signal for Fine-Grained Vision-Language Reasoning

    Sep 21, 2026Santi Ram Tiwari, Nihal Naik, Devbrat Pandey +1Fine-Grained PerceptionRecent Vision-Language Models

  7. When Evidence Conflicts: Reliability-aware Meta-review Generation

    Sep 21, 2026Xinzhe Wang, Fei Tao, Jiang Xie +2ReviewEvidence Conflict

  8. Beyond Accuracy: How Procedural Traces Shift the Decision Criterion of LLM Overseers

    Sep 16, 2026Zihan Chen, Di Zhu, Lei Zheng +1Model AuditingLarge Language Models Fail

  9. Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in Risk-of-Bias Assessment

    Sep 12, 2026Jiayu Huang, Zichen Tang, Qianhui Ling +2Clinical Reasoning TrainingLarge Language Model Reliability

  10. Every pooling rule has its world: matching probability combination rules to situations and stakes

    Aug 11, 2026Tanel Tammet, Priit Järv, Dirk DraheimProbabilityProbabilistic Model

  11. EvoTrustRAG: Evolution-Aware Conflict Attribution and Evidence Handling for Reliable Retrieval-Augmented Generation

    Aug 8, 2026Xi Nie, Hongwei Li, Shenghao Wu +3Evidence Conflict

  12. Artificial Intelligence Can Match Domain Experts in Evidence Extraction and Critical Appraisal of Microbial Oncogenesis Research Publications

    Aug 7, 2026Kaela Kokkas, Hairong Wang, Richard Klein +11Systematic ReviewBiomedical Text

  13. Same Evidence, Different Target: Decoding How Diagnostic Evidence Bears on Causal Questions from Language-Model States

    Jul 29, 2026Weiyi Kong, Zhuoran LiDiagnosisEvidence Conflict

  14. Auditing Evidence Use in Medical LLM Diagnosis

    Jul 23, 2026Junchi Liao, Jiawen Deng, Fuji RenDiagnosisEvidence Conflict

  15. The strength of clinical evidence is recoverable from language model representations but not from their stated grades

    Jun 27, 2026Soroosh Tayebi ArastehLarge Language Model ReliabilityEvidence Conflict

  16. ConflictScore: Identifying and Measuring How Language Models Handle Conflicting Evidence

    Jun 24, 2026Siyi Liu, Aaron Halfaker, Dan Roth +1Evidence ConflictTruth

  17. Where Is My Physics Wrong? Localized and Identifiable Discovery of Model Discrepancy

    Jun 22, 2026Yifan WangDiscrepancyModel Discovery

  18. Visualizing Uncertainty: Spatial Maps of Missing and Conflicting Evidence in Deep Learning

    Jun 14, 2026Dong Hyun Jeong, Feng Chen, Jin-Hee Cho +3Class Activation MappingPixel-Level Prediction

  19. Multi-Agent Framework for Audit Risk Assessment with Explicit Uncertainty and Evidence Conflict Modeling

    Jun 14, 2026Yuhan Wang, Manqing Wang, Yixuan Lu +2Model AuditingEvidence Conflict

  20. AbstRAG: Learning to Abstract for Retrieval Problems

    Jun 8, 2026Lei Xu, Xin Quan, Daniel Pedronette +1Question-Answering BenchmarksEvidence Conflict

  21. Evaluating RAG Reliability under Clean, Misleading, and Mixed Retrieval

    Jun 5, 2026Sevgi Yigit-SertMisinformationEvidence Conflict

  22. Output Type Before Quality: A Standards-Derived XAI Admissibility Rubric for Autonomous-Driving Safety

    Jun 3, 2026Abhinaw Priyadershi, Mandar Pitale, Jelena Frtunikj +1XaiAutonomous Driving

  23. Encoded but Not Routed: Explaining the Table-Chart Gap in Scientific Claim Verification

    Jun 1, 2026Sunisth Kumar, Xanh Ho, Tim Schopf +3Evidence ConflictChart

  24. StepGap: A Hybrid NLI-LLM Checker for Step-Level Evidence-Gap Detectionin Multi-Hop Question Answering

    May 23, 2026Yuelyu Ji, Zhuochun Li, Hui Ji +1Multi-Hop ReasoningEvidence Conflict

  25. CounterCount: A Diagnostic Framework for Counting Bias in Vision Language Models

    May 18, 2026Reem Alzahrani, Hassan Alshanqiti, Bushra Bin Hemid +3CountingMultimodal Reasoning

  26. Position: State-of-the-Art Claims Require State-of-the-Art Evidence

    May 17, 2026YongKyung OhArtificial Intelligence BenchmarksEvidence Conflict

  27. VideoSEAL: Mitigating Evidence Misalignment in Agentic Long Video Understanding by Decoupling Answer Authority

    May 12, 2026Chenhao Qiu, Yechao Zhang, Xin Luo +2Long Video Question AnsweringTemporal Grounding

  28. ArbGraph: Conflict-Aware Evidence Arbitration for Reliable Long-Form Retrieval-Augmented Generation

    Apr 20, 2026Qingying Niu, Yuhao Wang, Ruiyang Ren +2Evidence ConflictArbitration

  29. CARE: Privacy-Compliant Agentic Reasoning with Evidence Discordance

    Apr 1, 2026Haochen Liu, Weien Li, Rui Song +6Evidence ConflictMimic

  30. Disentangling Reasoning Logic to Resolve Explicit Knowledge Conflicts

    Aug 2, 2025Xianda Zheng, Zijian Huang, Meng-Fen Chiang +4LLM Reasoning StrategiesReasoning Skills

  31. DrugAgent: Reliable Multi-Agent Integration of Conflicting Biomedical Evidence for Drug-Target Interaction Assessment

    Aug 23, 2024Yoshitaka Inoue, Tianci Song, Xinling Wang +3Drug-Drug InteractionsDrug Discovery