AI for Science

Latest papers 117

All topics
CardsList
  1. Benchmarking AI Agents for Addressing Scientific Challenges Across Scales

    Jun 10, 2026Tianyu Liu, Allen Xin Wang, Antonia Panescu +30AI for ScienceAI Agent Evaluation

  2. On the Limits of LLM-as-Judge for Scientific Novelty Assessment

    Jun 10, 2026Soumitra Sinhahajari, Navonil Majumder, Soujanya PoriaAI for ScienceLLM-as-a-Judge

  3. Notes2Skills: From Lab Notebooks to Certainty-Aware Scientific Agent Skills

    Jun 10, 2026Shi Liu, Jiayao Chen, Chengwei Qin +3AI for ScienceDocument Information Extraction

  4. Twelve quick tips for designing AI-driven HPC workflows

    Jun 5, 2026Jamie J. AlnasirAI for ScienceHigh-Performance Computing

  5. Discovering Multiscale Deep Formulas in Complex Systems via Neural-Guided Lambda Calculus

    Jun 5, 2026Hanqiao Yu, Shusen Yang, Xuebin Ren +1AI for ScienceSymbolic Regression

  6. Towards World Models in Biomedical Research

    Jun 4, 2026Guangyu Wang, Jingkun Yue, Siqi Zhang +19AI for ScienceWorld Model Learning

  7. Simulate, Reason, Decide: Scientific Reasoning with LLMs for Simulation-Driven Decision Making

    Jun 3, 2026Yuhan Yang, Ruipu Li, Alexander RodríguezAI for ScienceNeuro-Symbolic Reasoning

  8. I-WebGenBench : Evaluating Interactivity in LLM-Generated Scientific Web Applications

    May 30, 2026Dasen Dai, Biao Wu, Meng Fang +2AI for ScienceWeb Application Generation

  9. 21cmEMUv3: a hybrid diffusion-LSTM emulator of 21cmFAST summary observables

    May 29, 2026Daniela Breitman, Andrei Mesinger, Steven G. Murray +2Simulation-Based InferenceAI for Science

  10. Physics Is All You Need? A Case Study in Physicist-Supervised AI Development of Scientific Software

    May 28, 2026Nhat-Minh NguyenAI for ScienceAI Coding Agents

  11. SoundnessBench: Can Your AI Scientist Really Tell Good Research Ideas from Bad Ones?

    May 28, 2026Sy-Tuyen Ho, Minghui Liu, Huy Nghiem +1AI for ScienceLLM Evaluation

  12. DeepSurvey: Agent-Oriented Automated Survey Generation with Analytical Depth and Citation Reliability

    May 28, 2026Ziyue Yang, Da Ma, Hanqi Li +8AI for ScienceAI Agents for Scientific Discovery

  13. SciIntBench: Measuring LLM Compliance with Research Integrity Norms Under Adversarial Framing

    May 28, 2026Almene De Meran Meguimtsop, Maria Leonor Pacheco, Daniel E. AcunaAI for ScienceAdversarial Attacks on LLMs

  14. Experiments in Agentic AI for Science

    May 25, 2026Judy Fox, Geoffrey FoxDocument UnderstandingAI for Science

  15. Position: AI for Science Should Treat Measurement-to-Dataset Pipelines as Inference Components

    May 23, 2026Ling Zhan, Xiaoyao Yu, Tao JiaAI for ScienceUncertainty Quantification

  16. The physics of AI weather models

    May 22, 2026George Craig, Tobias Selz, Matthias Beylich +1AI for ScienceRepresentational Similarity Analysis

  17. Cross-domain benchmarks reveal when coordinated AI agents improve scientific inference from partial evidence

    May 21, 2026Fiona Y. Wong, Markus J. BuehlerAI for ScienceMulti-Agent Coordination

  18. LABO: LLM-Accelerated Bayesian Optimization through Broad Exploration and Selective Experimentation

    May 21, 2026Zhuo Chen, Xinzhe Yuan, Jianshu Zhang +8AI for ScienceBayesian Optimization

  19. Artificial Intelligence Reshapes Microwave Photonics

    May 20, 2026Peng Li, Xihua Zou, Jia Ye +2AI for Science

  20. SciCustom: A Framework for Custom Evaluation of Scientific Capabilities in Large Language Models

    May 19, 2026Yiyang Gu, Junwei Yang, Junyu Luo +15AI for ScienceLLM Evaluation

  21. SCICONVBENCH: Benchmarking LLMs on Multi-Turn Clarification for Task Formulation in Computational Science

    May 18, 2026Nithin Somasekharan, Youssef Hassan, Shiyao Lin +5AI for ScienceLLM Evaluation

  22. KISS - Knowledge Infrastructure for Scientific Simulation: A Scaffolding for Agentic Earth Science

    May 18, 2026Ziwei Li, Liujun Zhu, Yuchen Liu +5AI for Science

  23. From Simulation to Discovery: AI Enabled Probabilistic Emulation of Mechanistic Crop Systems

    May 15, 2026Mojdeh Saadati, Juan Panelo, Gustavo Visentini +3Neural Surrogate ModelingAI for Science

  24. XDomainBench: Diagnosing Reasoning Collapse in High-Dimensional Scientific Knowledge Composition

    May 14, 2026Gong Zhiren, Tiantong Wu, Jiaming Zhang +9AI for ScienceLLM Evaluation

  25. Earth Science Foundation Models: From Perception to Reasoning and Discovery

    May 9, 2026Xiangyu Zhao, Bo Liu, Yuehan Zhang +9AI for ScienceGeospatial Foundation Models

  26. FAME: Forecasting Academic Impact via Continuous-Time Manifold Evolution

    May 8, 2026Jianrong Ding, Jianyuan Zhong, Zhengyan Shi +1AI for ScienceLLM Evaluation