ML Reproducibility

ML: Machine Learning

Momentum

14 papers in the last four weeks, up 100% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 88

All topics
CardsList
  1. GlucoTune: A Unified Framework for Blood Glucose Preprocessing, Forecasting, and Benchmarking in Diabetes

    Jul 23, 2026Davide Marelli, Giorgia Rigamonti, Mirko Paolo Barbato +1Type 1 DiabetesTime Series Forecasting

  2. Teach it to stop, not just to click

    Jul 19, 2026Barada Sahu, Shivesh PandeyAI Agent ReliabilityAgent Reliability

  3. Is Model Instability just Noise to be Tolerated or a Property that can be Managed?

    Jul 11, 2026Amirali Rayegan, Lunxiao Li, Tim MenziesStochastic OptimizationAutomated Software Engineering

  4. GPUSimBench: Towards Scalable and Reliable GPU-Accelerated Simulators in Embodied AI

    Jul 6, 2026Huzhenyu Zhang, Shenghai Yuan, Wenrui Yan +4GPU AccelerationRobotics Simulation

  5. Coding-agents can replicate scientific machine learning papers

    Jul 2, 2026Atharva Hans, Ilias BilionisCoding AgentsLLM Agent Evaluation

  6. The FID Lottery: Quantifying Hidden Randomness in Generative-Model Evaluation

    Jun 18, 2026Nicolas Dufour, Alexei A. Efros, Patrick PérezML ReproducibilityImage Generation Evaluation

  7. ReproRepo: Scaling Reproducibility Audits with GitHub Repository Issues

    Jun 16, 2026Shanda Li, Qiuhong Anna Wei, Jingwu Tang +5LLM Agent EvaluationAI Agent Benchmarks

  8. The Shift Toward Open and Reproducible AI Research

    Jun 15, 2026Kevin L Coakley, Thijs Snelleman, Holger Hoos +1ML ReproducibilityScientific Reproducibility

  9. Incentives and Evidence in Learned Service Orchestration

    Jun 15, 2026Syed Izhan Khilji, Alireza Furutanpey, Schahram DustdarRL ControlReinforcement Learning

  10. RecourseBench: A Modular Framework for Reproducible Algorithmic Recourse Evaluation

    Jun 15, 2026Zahra Khotanlou, Hashir Ahmed, Chenghao Tan +2Benchmark DesignAutomated Evaluation

  11. Mojo: A Promising Tool for Scalable Financial AI Efficiency

    Jun 14, 2026Henry HanQuantitative FinanceML Reproducibility

  12. BrainSurgery: Reproducible and Reliable Declarative Weight Manipulations for Model Editing and Upcycling

    Jun 8, 2026Gianluca Barmina, Annemette Broch Pirchert, Andrea Blasi Núñez +2ML Reproducibility

  13. Execution Realism and Reproducibility in LLM-Based Trading Systems: A Systematic Scoping Review and Evidence Audit

    Jun 6, 2026Junyi Yao, Zihao Zheng, Baichuan Li +1ML ReproducibilityFinance

  14. Accelerating Reproducible Research in Synthetic EHR Generation

    Jun 5, 2026Jalen Jiang, Chufan Gao, Ethan Rasmussen +2Synthetic Data GenerationML Reproducibility

  15. Jacobi-Anger Method for Deterministic Initialization in Implicit Neural Representation

    Jun 4, 2026Mohammed Alsakabi, Kejia Hu, John M. Dolan +1Implicit Neural RepresentationsNeural Network Initialization

  16. Tight list replicability bounds via a novel sphere covering theorem

    Jun 4, 2026Ari Blondal, Hamed Hatami, Pooya Hatami +2ML ReproducibilityStatistical Learning Theory

  17. Revisiting Vul-RAG: Reproducibility and Replicability of RAG-based Vulnerability Detection with Open-Weight Models

    Jun 3, 2026Sabrina Kaniewski, Fabian Schmidt, Tobias HeerRetrieval-Augmented GenerationLLM Evaluation

  18. Reproducibility is the New Copyleft: Defining AGI-oriented Reproducible Builds

    Jun 2, 2026Masayuki HattaML ReproducibilityAI Governance

  19. ERICA: Quantifying Replicability of Cluster Analysis

    May 29, 2026Siamak K. Sorooshyari, Manuel A. Rivas, Robert TibshiraniClusteringML Reproducibility

  20. Modeling Robotics Dataset Construction as an Artifact-Based Build Process

    May 29, 2026Leon Pohl, Lukas Beer, George Sebastian +1RoboticsAutomated Software Engineering

  21. A Unified and Reproducible Experimentation Framework for Speech Understanding

    May 29, 2026Jing Peng, Junhao Du, Chenghao Wang +21Audio-Language Model EvaluationML Reproducibility

  22. Croissant Tasks: A Metadata Format for Reproducible Machine Learning Evaluations

    May 28, 2026Omar Benjelloun, Leonardo Martins Bianco, Isabelle Guyon +8ML Reproducibility

  23. stable-worldmodel: A Platform for Reproducible World Modeling Research and Evaluation

    May 20, 2026Lucas Maes, Quentin Le Lidec, Luiz Facury +9World ModelsML Reproducibility

  24. A Reproducible Log-Driven AutoML Framework for Interpretable Pipeline Optimization in Healthcare Risk Prediction

    May 19, 2026Rui Huang, Lican HuangClass-Imbalanced LearningInterpretable ML