Cross Validation

Momentum

20 papers in the last four weeks, against 2 the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 91

All topics
CardsList
  1. Model validation in machine learning: A scenario-based guide from hold-out splits to nested group cross-validation in biomedical and applied research

    Oct 1, 2026Mehmet Baygin, Sengul Dogan, Turker TuncerCross ValidationValidation

  2. Semantic RGB--Depth Based Surgical Skill Assessment in Microscopic Stereo Videos

    Oct 1, 2026Jecia Z. Y. Mao, Sue M. Cho, Francis X. Creighton +3Rgb-Depth CamerasSurgery

  3. RAGScope: A Leakage-Controlled, Cost-Aware Evidence-Gating Protocol for RAG Hallucination Triage

    Sep 30, 2026Zeming Liu, Qibai Chen, Jingtao Zhang +1LeakageCost-Aware

  4. An Input-Frugal Deep Learning Framework for Weather-Driven National Crop-Yield Forecasting: A Case Study of Brazilian Soybean

    Sep 29, 2026Fernando Dupin da Cunha Mello, Prashant Kumar, Erick G. Sperandio NascimentoAgricultural PredictionPrecision Agriculture

  5. Beyond Interaction Capacity: Estimator Scaling with Recursive Models for CTR Prediction

    Sep 29, 2026Shivang Chopra, Fotis Iliopoulos, Zsolt Kira +1Click-Through Rate PredictionReal-World Content Recommendation Problem

  6. Nürnberg NLP at ChildSafeAds 2026: Structurally Dissimilar Voter Ensembles under Four Levels of Data Access

    Sep 28, 2026Philipp Steigerwald, Eric Rudolph, Jens AlbrechtContent ModerationMajority Voting

  7. When local gains fail to transfer: Frozen Earth-observation embeddings across wildfires

    Sep 28, 2026Philipp Stark, Alexandros Sopasakis, Ola HallWildfire PredictionWildfire

  8. Cross-Scale Transfer Learning for Depression Severity Prediction: From PHQ-8 to HAMD-17 Across Languages and Clinical Paradigms

    Sep 23, 2026Wenjie Feng, Sahba Zojaji, Satoshi NakamuraDepressionCross-Lingual Transfer

  9. Benchmarking Active Spot Selection for Cost-Efficient Spatial Transcriptomics

    Sep 23, 2026Zheyu Zhu, Junchao Zhu, Fengbei Liu +7Spatial TranscriptomicsActive Learning

  10. CORE-STACK+: Meta-Learning for Deep Stacked Generalization

    Sep 22, 2026Noor Islam S. MohammadEnsembleMeta-Learning

  11. Brain Metastases Segmentation for BraTS 2026 Task 1: A Multi-Architecture Comparison

    Sep 21, 2026Mahdi Islam, Musarrat TabassumBrain Tumor SegmentationCross Validation

  12. Prediction-Powered Smoothing and Validation for Disaggregated AI Evaluation

    Sep 17, 2026Sho Kawano, Zehang Richard Li, Paul A. ParkerArtificial Intelligence EvaluationConfidence Intervals

  13. Not All Nodes Are Created Equal: Homophily-Aware Stratification for Stable GNN Evaluation

    Sep 16, 2026Naga Venkata Sai Jitin Jami, Thomas Altstidl, Sebastian Hoefler +4Graph Neural NetworksCross Validation

  14. The Unbearable Weight: Scaling Models and Methods for UAV Audio Classification

    Sep 15, 2026Andrew P. Berg, Qian Zhang, Mia Y. WangDrone DetectionUnmanned Aerial Vehicles

  15. Assessing nnU-Net Generalization across Brain Tumor Populations in BraTS-GoAT 2026

    Sep 14, 2026Tristan Kirscher, Vivian Metzger, Philippe Meyer +1Brain Tumor SegmentationBrain Tumor Classification

  16. Estimating Pedestrian Volumes from GIS-Derived Built-Environment Features: A Machine Learning Framework

    Sep 14, 2026Bahareh Golchin, Banafsheh Rekabdar, Sirisha Kothuri +1Urban EnvironmentsGradient Boosted Decision Tree

  17. Rethinking Sign Language Translation: The Impact of Signer Dependence on Model Evaluation

    Sep 7, 2026Keren Artiaga, Sabyasachi Kamila, Haithem Afli +2Gloss-Free Sign Language TranslationSign Language Translation

  18. Which Site, and When: A Free-Satellite-Data Test of Himalayan Glacial Lake Bursts, Landslides, and Ice Floods

    Aug 12, 2026Matthew Kahn, Milan Arjel, Nirmala Adhikari +2LandslidesSen1Floods11

  19. Disentangling Co-Occurring Retinal Pathologies with Saliency-Guided Sparse Expert Routing

    Aug 10, 2026Nagur Shareef Shaik, Jeongwoo Park, Yeong-Jin Kim +3Fundus ImagesExperts

  20. Machine Learning and ARIMA Model Averaging for Adaptive Public Health Forecasting: Comparative Evaluation and an Ontario COVID-19 Case Study

    Aug 7, 2026Yushu Zou, Ye Li, Johra Moosa +3Covid-19Cross Validation

  21. Reassessing the Feasibility of PPG-Based Non-Invasive Blood Glucose Level Estimation

    Aug 3, 2026Supraja Ramesh, Markus Neufeld, Michael Küttner +2Continuous Glucose MonitoringRemote Photoplethysmography

  22. Multi-Backbone Self-Supervised Ensembles for Audio Deepfake Detection and a Cross-Track Analysis of Generation-Detection Asymmetry

    Aug 3, 2026Seunghyun Kim, Junghyun Kim, Jiyoung WooAudio Deepfake DetectionAudio Understanding

  23. What Is Missing in Surgical Risk Stratification and Outcome Prediction: A Scoping Review of End-to-End Machine Learning Approaches

    Jul 31, 2026Yizhi Dong, Yuhe Ke, Hairil Rizal Abdullah +4Electronic Health RecordsCross Validation

  24. Loss Invariance Determines What Concept Layers Encode: Volume Grounding in Echocardiography

    Jul 28, 2026Hyunkyung Han, Min Jung KimLeft-Ventricular Ejection FractionCardiac Motion

  25. A Distributional Robustness Margin For Pathology Foundation Models

    Jul 28, 2026Clément Grisi, Jeroen van der Laak, Geert LitjensPathology Foundation ModelsCross Validation

  26. PIcsC: Partitioning-Induced Covariate Shift Correction

    Jul 28, 2026Behraj Khan, Behroz Mirza, Syed Ahmad Chan Bukhari +1Covariate ShiftFederated Learning

  27. Leak-Free Cross-Validated Stacking with Per-Architecture Calibration for Sand-Boil Segmentation in Earthen Levees

    Jul 28, 2026Padam Jung Thapa, Anav Katwal, Ayon Dey +4Cross ValidationWater

  28. Neurai-VN Benchmark: Standardized Machine Learning Models for Multimodal Digital Phenotyping in Mental Health Classification

    Jul 28, 2026Quoc-Cuong Pham, Hoang-Thuy-Duong Vu, Thi-Thanh-Huong Ha +1Mental HealthMultimodal Clinical Data

  29. Shape-Based Inductive Bias for Glioma Grading from Tumor Contours

    Jul 27, 2026Puneet Velidi, Michelle F. Miranda, Farouk Nathoo +2GliomaMultiple Instance Learning

  30. External Clustering Validation by the Homogeneity-Parsimony Trade-off

    Jul 22, 2026Andreas Tiffeau-MayerClusteringSpearman Correlation

  31. Spatially Grounded Concept Bottleneck Models for Trustworthy Breast Ultrasound Diagnosis

    Jul 22, 2026Moshiur Rahman Tonmoy, Dunren Che, Haitham Y. Adarbah +1MammographyConcept Bottleneck Models

  32. Position: Explanation Stability Is a Property of the Model Method Pair, Not the Model

    Jul 18, 2026Kabilan Elangovan, Daniel TingExplainabilityGradient-Weighted Class Activation Mapping

  33. TellTale: Blending Multi-Instance LoRA Text Encoders and a Zero-Shot LLM Judge for Ambivalence/Hesitancy Recognition in Videos

    Jul 18, 2026Abdel-Karim Al-Tamimi, Ali RodanTranscriptLarge Language Model Judges

  34. Adapting Evidential Neural Networks to Test-Time Neighbor Fusion Improves Molecular Property Prediction

    Jul 13, 2026Cameron Gruich, Weichi Yao, Yixin Wang +1Molecular Property PredictionEvidential Uncertainty

  35. Auditing Construct Overlap in Explainable Machine Learning: Evidence from Burnout-Depression Prediction Across Student Cohorts

    Jul 12, 2026Alireza Dehghan, Negin AshrafiXaiMental Health

  36. The Regularization Parameter: Sparse Precision Matrix Estimation

    Jul 7, 2026Aryan Eftekhari, Daniel Sergio Vega, Ernst-Jan Camiel Wit +1Maximum LikelihoodRegularization

  37. The Good, the Bad, and the Brittle: Benchmarking Robustness and Generalisation of Histopathology Foundation Models

    Jul 5, 2026Dhyey Yajnik, Amina Asif, Fayyaz MinhasPathology Foundation ModelsComputational Pathology

  38. Semantic Segmentation-Driven Image-Level Diagnosis of Liver Cancers in Hematoxylin and Eosin Histopathology Images

    Jul 3, 2026Ivica Kopriva, Dario Sitnik, Arijana Pacic +3Digital PathologyCholangiocarcinoma

  39. Interpretable vs Learned Encoders for High-Cardinality Fraud Detection

    Jul 1, 2026Xiao Han, Jingjing Liu, Moxuan Zheng +2Fraud DetectionXgboost Model

  40. Accelerating Conformal Prediction via Approximate Leave-One-Out

    Jun 30, 2026Jiachen Cong, Jingbo LiuOnline Conformal PredictionCross Validation

  41. TRACE: A Concept Bottleneck Model for Longitudinal 3D Glioblastoma Response Assessment

    Jun 29, 2026Alia Tarek, Hamsa Saberr, Hamza Elghonemy +6GliomaConcept Bottleneck Models

  42. CW-B: Class Weighted Boosting Framework for Imbalance Resilient Multi Class Cardiac Phenotyping

    Jun 29, 2026Sijia Li, Xiaoyu Tan, Chen Zhan +3Imbalanced ClassificationXgboost Model

  43. Evaluation-Strategy Gap in Fault Diagnosis of Deep Learning Programs

    Jun 25, 2026Sigma JahanFault DiagnosisReal-World Cloud Fault Injection Dataset

  44. Federated Survival Analysis in Healthcare: A Multi-Model Evaluation on Cross-Institutional Heterogeneous Breast Cancer Data

    Jun 22, 2026Natalia Moreno-Blasco, Anusha Ihalapathirana, Pekka Siirtola +1Survival AnalysisMultidisciplinary Tumor Boards

  45. Machine Learning Classification of Cryopathy Syndromes: A Comprehensive Comparative Study

    Jun 18, 2026Nataliya Shakhovska, Valentyna Chopyak, Ivan Izonin +1Clinical PredictionClassifier

  46. Context-Aware Hierarchical Bayesian Modeling of IVF Laboratory Environmental Conditions

    Jun 18, 2026Zahra Asghari Varzaneh, Reza Khoshkangini, Pia Saldeen +2BiomarkerCross Validation

  47. Cluster LOCO: Feature Importance For Interpreting Clusters

    Jun 12, 2026Claire M. He, Genevera I. AllenFeature ImportanceClustering

  48. Deep Sleep Classification via EEG Signal Criticality: A Passive BCI Approach for Sleep-Improvement Neurofeedback

    Jun 11, 2026Stanisław Narębski, Tomasz Komendziński, Tomasz M. RutkowskiSleepElectroencephalography

  49. Crossing the Validation Crisis: Cross-Validation Reduces Benchmarking Variance Surprisingly Well

    Jun 10, 2026Célestin Eve, Gaël Varoquaux, Thomas MoreauCross ValidationVariance

  50. Finding Most Influential Sets

    Jun 4, 2026Lucas D. Konrad, Nikolas KuschnigInfluence FunctionCross Validation