Scientific Claim Verification

Latest papers 36

All topics
CardsList
  1. When Evidence Changes the Subject: Subject-Typed Claim Licensing for Learned Routing

    Sep 27, 2026Jian Chen, Zixuan YuanEvidence-Grounded ReasoningScientific Claim Verification

  2. RINI: Seeing the Prior Is Not Enough

    Sep 27, 2026Hongyi Du, Tianyi Zhang, Heng Wang +7Novelty SearchAI-Assisted Scientific Research

  3. PaperDoctor: Evidence-Grounded and Actionable Feedback for Scientific Papers in Progress

    Sep 15, 2026Kevin Qinghong Lin, Siyuan Hu, Pan Lu +14AI-Assisted Scientific ResearchScientific Reproducibility

  4. SciTrue: Reliable Scientific Claim Validation with Frontier and Open Language Models at the NTCIR SciClaimEval Task

    Sep 1, 2026Qiming Bao, Neşet Özkan Tan, Siyuan Wang +1Document UnderstandingLLM Evaluation

  5. TRACES: A Benchmark for Epistemic Reliability in Scientific Reasoning by LLMs

    Aug 11, 2026Valentin Rodionov, Shamil AssylbekovLLM EvaluationLLM Reliability

  6. HNR-DAC: Hard-Negative Reranking and Distribution-Aligned Classification for Scientific Claim Verification

    Aug 7, 2026Zhenchao Wang, Xin Chen, Luoxi Zhang +2Claim VerificationDistribution Shift

  7. When Retrieval Helps and Distracts: Evaluating Evidence-Generating LLMs for Biomedical Claim Verification

    Aug 2, 2026Pritam Deka, Prabhjot SinghExplainable Artificial IntelligenceAutomated Fact-Checking

  8. Auditing Discovery Claims: A Two-Sided Criterion for Agentic Science, with the Negative Side Decidable

    Aug 2, 2026Wenhui Chen, Jianlin Chen, Ziyao Lin +1Reward HackingAI for Science

  9. Opaque Epistemic Mediation: How LLM Deployment Configurations Shape the Validation of Pseudo-Science

    Jul 24, 2026Davide Scarso, Hugo Noronha de Almeida, Joaquim PinaLLM EvaluationLLM Auditing

  10. Grounded verification of chemical and materials reasoning: detection is the bottleneck

    Jul 19, 2026Can Polat, Mustafa Kurban, Erchin Serpedin +1LLM Self-CorrectionLLM Grounding

  11. ToolSciVer: Multimodal Scientific Claim Verification with Visual Tool Augmented Reinforcement Learning

    Jul 17, 2026Binglin Zhou, Peng Shi, Ryo Kamoi +2Tool Use in VLMsScientific Claim Verification

  12. VERITAS: Towards a General-Purpose Replication Tool for Scientific Research

    Jul 3, 2026Haokun Liu, Filbert Aurelian Tjiaranata, Chenhao TanAI Coding AgentsScientific Reproducibility

  13. Coding-agents can replicate scientific machine learning papers

    Jul 2, 2026Atharva Hans, Ilias BilionisCoding AgentsLLM Agent Evaluation

  14. SFBench: The SciFy Scientific Feasibility Benchmark

    Jun 28, 2026Cash Costello, James Mayfield, Elsbeth Turcan +7LLM EvaluationBenchmark Design

  15. Position: Correct Answer, Wrong Mechanism -- When AI Scientists Defend General Claims Their Own Data Contradicts

    Jun 22, 2026Steven Young EuligAI Agent ReliabilityReasoning Evaluation

  16. Finetuning with Scientific Data Increases Hallucinations: A Multi-domain Factuality Evaluation of LLMs

    Jun 19, 2026Raia Abu Ahmad, Nikolas Rauscher, Ekaterina Borisova +3LLM EvaluationLLM Fine-Tuning

  17. SciLens: Multi-modal Scientific Claim Verification with Agentic Entailment and Grounding

    Jun 18, 2026Yueming Wang, Tianshi Zheng, Jiaxin Bai +3Multimodal GroundingAI for Science

  18. Making AI Scientists Auditable from Evidence to Claim

    Jun 17, 2026Zijian Wang, Hanqi Li, Ziyue Yang +17Data ProvenanceScientific Reproducibility

  19. Traxia: A Framework for Verifiable, Agent-Native Scientific Publishing

    Jun 6, 2026Wisdom DogahData ProvenanceScholarly Peer Review

  20. Encoded but Not Routed: Explaining the Table-Chart Gap in Scientific Claim Verification

    Jun 1, 2026Sunisth Kumar, Xanh Ho, Tim Schopf +3VLM InterpretabilityChart Understanding

  21. DeepSciVerify: Verifying Scientific Claim--Citation Alignment via LLM-Driven Evidence Escalation

    May 26, 2026Shaghayegh Sadeghi, Khashayar Khajavi, Rise Adhikari +1Selective PredictionCitation Verification

  22. ScientistOne: Towards Human-Level Autonomous Research via Chain-of-Evidence

    May 25, 2026Rui Meng, Bhavana Dalvi Mishra, Jiefeng Chen +10Data ProvenanceCitation Verification