Scientific Reasoning

Latest papers 39

All topics
CardsList
  1. ScienceArena: Benchmarking LLMs on Latest Scientific Olympiad Competitions

    Aug 31, 2026Guangxiang Zhao, Qilong Shi, Xusen Xiao +13LLM EvaluationScientific Reasoning

  2. SPARK: Skeleton-Guided Reasoning Synthesis from Large-Scale Scientific Literature

    Aug 31, 2026Yu Li, Wei Li, Xin Gao +4Evidence-Grounded ReasoningScientific Reasoning

  3. Memory Is Not Always Needed: Characterizing Conditional Memory in Scientific Reasoning

    Aug 25, 2026Zhen Bi, Xueshu Chen, Yan Wang +6Memory-Augmented Language ModelsScientific Reasoning

  4. MUSE: A Full-Text Cross-Domain Knowledge Base of Scientific Problems, Solutions, and Rationales

    Aug 11, 2026Tsofia Cohen, Tom HopeRelation ExtractionKG Construction

  5. Science Edge Evaluation: SEE the Missing Step Toward Real Scientific Discovery

    Aug 7, 2026Taolin Han, Yuchen Zhang, Jinghang Wang +22Scientific ReasoningScientific Discovery

  6. Chemical Chain-of-Thought Functions as a Hallucination-Prone Molecular Scratchpad

    Jul 23, 2026Jiatong Li, Yuxuan Ren, Weida Wang +2CoT FaithfulnessScientific Reasoning

  7. Are LLMs Ready for Scientific Discovery? A Capability-Oriented Benchmark for AI Scientists

    Jul 13, 2026Chuhan Shi, Xiaoquan Ren, Sicheng Song +3AI for ScienceLLM Evaluation

  8. Ideas Have Genomes: Benchmarking Scientific Lineage Reasoning and Lineage-Grounded Idea Generation

    Jul 9, 2026Yifan Zhou, Qihao Yang, Yan Li +14Scientific ReasoningScientific Hypothesis Generation

  9. A safety-oriented hypothetico-deductive framework for AI-assisted differential diagnosis

    Jul 9, 2026Fan Ma, Mauro Giuffrè, Donald Wright +12Scientific ReasoningMedical Diagnosis

  10. Accurate, Interdisciplinary and Transparent Structure-property Understanding with Deep Native Structural Reasoning

    Jul 8, 2026Chen Tang, Yizhou Wang, Jianyu Wu +26Scientific ReasoningMaterials Property Prediction

  11. IsoSci: A Benchmark of Isomorphic Cross-Domain Science Problems for Evaluating Reasoning versus Knowledge Retrieval in LLMs

    Jul 1, 2026Samir Abdaljalil, Erchin Serpedin, Hasan KurbanLLM EvaluationScientific Reasoning

  12. Accelerating Returns and the Qualitative Engine for Science

    Jun 24, 2026Guojun LiaoAI for ScienceScientific Reasoning

  13. SciLens: Multi-modal Scientific Claim Verification with Agentic Entailment and Grounding

    Jun 18, 2026Yueming Wang, Tianshi Zheng, Jiaxin Bai +3Multimodal GroundingAI for Science

  14. A Three-Layer Framework for AI in Scientific Discovery

    Jun 11, 2026Guojun LiaoAI for ScienceScientific Reasoning

  15. TerraBench: Can Agents Reason Over Heterogeneous Earth-System Data?

    Jun 11, 2026Dat Tien Nguyen, Thao Nguyen, Fadillah Adamsyah Maani +5AI Agents for Scientific DiscoveryScientific Reasoning

  16. SciR: A Controllable Benchmark for Scientific Reasoning in LLMs

    Jun 11, 2026Pierre Beckmann, Marco Valentino, Andre FreitasLLM EvaluationScientific Reasoning

  17. DN-Hypo-Pipeline: An AI-Driven Workflow for Generating Hypotheses using Large Language Models and Scientific Explanations

    Jun 7, 2026Lei Lin, Ronghao Wang, Chunbao Zhou +2Scientific ReasoningScientific Hypothesis Generation

  18. Contemporary AI lacks the imagination to diverge or negate in science

    Jun 6, 2026Honglin Bao, Siyang Wu, Xiao Liu +3LLM-as-a-JudgeScientific Reasoning

  19. SCI-PRM: A Tool Aware Process Reward Model for Scientific Reasoning Verification

    Jun 3, 2026Xiangyu Zhao, Henry Hengyuan Zhao, Yiheng Wang +7Process Reward ModelsScientific Reasoning

  20. NewtPhys: Do Foundation Models Understand Newtonian Physics?

    Jun 2, 2026Sebastian Cavada, Soumava Paul, Tuan-Hung Vu +2VLM EvaluationScientific Reasoning

  21. Science Earth: Towards A Planet-Scale Operating System for AI-Native Scientific Discovery

    May 31, 2026Zhe Zhao, Haibin Wen, Yingcheng Wu +10Multi-Agent CoordinationMulti-Agent Orchestration

  22. ProjectionBench: Evaluating Scientific Hypothesis Generation in LLMs Under Progressive Information Disclosure

    May 28, 2026A. J. Lew, Y. Cao, M. J. BuehlerLLM EvaluationScientific Reasoning

  23. On the evolution of the concept of probability as a mirror of the evolution of reason

    May 26, 2026Jean-Louis Le Mouël, Vincent Courtillot, Dominique Gibert +6Scientific ReasoningEpistemic Uncertainty

  24. Geo-Expert: Towards Expert-Level Geological Reasoning via Parameter-Efficient Fine-Tuning

    May 24, 2026Chenyou Guo, Zongqi Liu, Yizhou Zhang +2Scientific ReasoningLLM Fine-Tuning

  25. Cross-domain benchmarks reveal when coordinated AI agents improve scientific inference from partial evidence

    May 21, 2026Fiona Y. Wong, Markus J. BuehlerAI for ScienceMulti-Agent Coordination

  26. Scientific Logicality Enriched Methodology for LLM Reasoning: A Practice in Physics

    May 16, 2026Zhaoxin Yu, Nan Xu, Kun Chen +3Scientific ReasoningScientific QA

  27. XDomainBench: Diagnosing Reasoning Collapse in High-Dimensional Scientific Knowledge Composition

    May 14, 2026Gong Zhiren, Tiantong Wu, Jiaming Zhang +9AI for ScienceLLM Evaluation