Overfitting

Momentum

9 papers in the last four weeks, against 1 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 48

All topics
CardsList
  1. Misalignment of Low-Loss Regions Causes Grokking

    Sep 30, 2026Yongding Tian, Zaid Al-Ars, Maksim Kitsak +1GrokkingOverfitting

  2. Forking: Sudden Overfitting Under Replay

    Sep 30, 2026Shanbin Yu, Shaoyang Guo, Haoran Zhao +2OverfittingCatastrophic Forgetting

  3. Benign Overfitting for General Norms and Distributions

    Sep 27, 2026Daniel Barzilai, Ohad ShamirOverfittingSpectral Norm

  4. Double Descent and Malign Overfitting in Diffusion Models

    Sep 22, 2026Raphaël Urfin, Tony Bonnaire, Giulio Biroli +1OverfittingOverparameterization

  5. MaskVLA: Visual Masking Against Trajectory Overfitting of Vision-Language-Action Model

    Sep 20, 2026Yuxuan Jiang, Jiaying Huang, Ge Wang +9Diffusion-Based Vision-Language-ActionsOverfitting

  6. Structured Features Overfit Where Random Features Grok

    Sep 14, 2026Chon-Fai Kam, Miloud Bessafi, Frederic CadetOverparameterizationOverfitting

  7. SynthSentry: Detecting Synthetic Data Contamination in Language Model Training Data

    Sep 14, 2026Praveen Kumar Myakala, Ravichandra Namburi, Sowmya Keragodu Jayaramu +1Synthetic DataTraining Data

  8. Data Scarcity and Model Sparsity: Mixtures-of-Experts Overfit More to Repeated Data

    Sep 10, 2026Atindra Jha, Margaret Li, Jure Leskovec +2Mixture-Of-ExpertsOverfitting

  9. Overfitting Mitigation via Singular Value Decomposition in Minimum Bayes Risk Decoding

    Sep 1, 2026Riza Setiawan Soetedjo, Yusuke Sakai, Hidetaka Kamigaito +2Singular Value DecompositionLow-Rank Structure

  10. High-dimensional ridgeless least squares interpolation under spiked covariance structures

    Aug 7, 2026Zhijun Liu, Dandan JiangKernel Ridge RegressionCovariance

  11. Rethinking Self-Evolution: A Constrained Exploration-Exploitation Process for Mitigating Skill Overfitting

    Jul 29, 2026Hongqiang Lin, Chao Liu, Xiaofan Bai +4Skill EvolutionSkills

  12. MxGPS: Multiplex Graph Transformers for a Power Grid Foundation Model

    Jul 15, 2026Charilaos Papaioannou, Ioannis Tsantilas, Dimitris Giannakakos +9Optimal Power FlowMultiplex Graph Transformers

  13. Broken Ergodicity and the Violation of the Fluctuation-Dissipation Theorem Lead to Generalization Beyond Overfitting in Machine Learning

    Jul 5, 2026Chan Li, Nigel GoldenfeldFluctuation-Dissipation TheoremMean-Field Limit

  14. Benign Overfitting Does Not Occur in Diffusion Models

    Jul 2, 2026Tyler Farghly, Benjamin Dupuis, Alain Durmus +1OverfittingScore-Based Diffusion Model

  15. Demystifying Training-Time Augmentation for Data-Constrained Language Model Pretraining

    Jun 15, 2026Michael K. Chen, Xikun Zhang, Fan Bai +2Large Language Model PretrainingData Augmentation

  16. What Fits (Into Few Tokens) Doesn't Overfit: Compression and Generalization in ML Research Agents

    Jun 9, 2026Martin Andres Bertran, Aaron Roth, Zhiwei Steven WuMle-Bench LiteOverfitting

  17. Assessing True Generalisability of Audio-Visual Speech Recognisers

    Jun 5, 2026Zhaofeng Lin, Stavros Petridis, Maja Pantic +1Automatic Speech Recognition EvaluationOverfitting

  18. SORA: Free Second-Order Attacks in Fast Adversarial Training

    May 30, 2026Mazdak Teymourian, Ramtin Moslemi, Farzan Rahmani +1Adversarial TrainingAttention-Guided Training

  19. Resolving Endpoint Underfitting in Diffusion Bridges via Noise Alignment

    May 27, 2026Yurong Gao, Zicheng Zhang, Congying Han +2Diffusion BridgesImage Restoration

  20. A Principled Self-Referenced Early Stopping Approach for Deep Image Prior

    May 24, 2026Chaoyan Huang, Cheng-Han Huang, Ismail R. Alkhouri +1Visual PriorsBayesian Inverse Problems

  21. Test-Time Training Undermines Safety Guardrails

    May 21, 2026Simone Antonelli, Sadegh Akhondzadeh, Aleksandar BojchevskiInference-Time DefenseTest-Time Training

  22. Beyond Temperature: Hyperfitting as a Late-Stage Geometric Expansion

    May 21, 2026Meimingwei Li, Yuanhao Ding, Esteban Garces Arias +1Overfitting

  23. Toward Understanding Adversarial Distillation: Why Robust Teachers Fail

    May 21, 2026Hongsin Lee, Hye Won ChungTeacher-Student DistillationDataset Distillation

  24. TextReg: Mitigating Prompt Distributional Overfitting via Regularized Text-Space Optimization

    May 20, 2026Lucheng Fu, Ye Yu, Yiyang Wang +4OverfittingText-Driven

  25. Reconciling Contradictory Views on the Effectiveness of SFT in LLMs: An Interaction Perspective

    May 18, 2026Junpeng Zhang, Lei Cheng, Guoxi Zhang +3Large Language Models FailOverfitting

  26. Detecting overfitting in Neural Networks during long-horizon grokking using Random Matrix Theory

    May 12, 2026Hari K. Prakash, Charles H MartinOverfittingNeural Network Training

  27. FedOUI: OUI-Guided Client Weighting for Federated Aggregation

    May 12, 2026Alberto Fernández-Hernández, Jose I. Mestre, Cristian Pérez-Corral +3Federated LearningFedavg

  28. OUI as a Structural Observable: Towards an Activation-Centric View of Neural Network Training

    May 12, 2026Alberto Fernández-Hernández, Jose I. Mestre, Cristian Pérez-Corral +3Deep NetworkNeural Network

  29. Data-driven transport modelling without overfit

    May 9, 2026Peter Vanya, Katarína Šimková, Rastislav FarkašTransportData-Driven

  30. When Does ℓ2\ell_2-Boosting Overfit Benignly? High-Dimensional Risk Asymptotics and the ℓ1\ell_1 Implicit Bias

    May 7, 2026Ye Su, Jian Li, Yong LiuOverfittingEmpirical Risk Minimization

  31. Understanding diffusion models requires rethinking (again) generalization

    May 7, 2026Pierre Marion, Yu-Han WuOverfittingDiffusion Models

  32. MER-DG: Modality-Entropy Regularization for Multimodal Domain Generalization

    May 3, 2026Yavuz Yarici, Ghassan AlRegibMultimodal Domain GeneralizationCross-Modal

  33. Unveiling the Backdoor Mechanism Hidden Behind Catastrophic Overfitting in Fast Adversarial Training

    Apr 27, 2026Mengnan Zhao, Lihe Zhang, Tianhang Zheng +2Adversarial TrainingOverfitting

  34. Mitigating Error Amplification in Fast Adversarial Training

    Apr 27, 2026Mengnan Zhao, Lihe Zhang, Bo Wang +3Adversarial TrainingAttention-Guided Training

  35. Learning Curves and Benign Overfitting of Spectral Algorithms in Large Dimensions

    Apr 25, 2026Weihao Lu, Qian Lin, Yingcun Xia +1Kernel Ridge RegressionSpectral Representation Method

  36. Exploiting LLM-as-a-Judge Disposition on Free Text Legal QA via Prompt Optimization

    Apr 22, 2026Mohamed Hesham Elganayni, Runsheng Chen, Sebastian Nagl +1Llm-As-A-JudgePrompt Optimization

  37. Benign Overfitting in Adversarial Training for Vision Transformers

    Apr 21, 2026Jiaming Zhang, Meng Ding, Shaopeng Fu +2Adversarial TrainingSelf-Supervised Vision Transformers

  38. Superficial Success vs. Internal Breakdown: An Empirical Study of Generalization in Adaptive Multi-Agent Systems

    Apr 21, 2026Namyoung So, Seokgyu Jang, Taeuk KimModel-Based Multi-Agent SystemsOverfitting

  39. Test-Time Perturbation Learning with Delayed Feedback for Vision-Language-Action Models

    Apr 20, 2026Zehua Zang, Xi Wang, Fuchun Sun +4Diffusion-Based Vision-Language-ActionsTest-Time Adaptation

  40. Grokking of Diffusion Models: Case Study on Modular Addition

    Apr 20, 2026Joon Hyeok Kim, Yong-Hyun Park, Mattis Dalsætra Østby +1Diffusion ModelsGrokking

  41. Spectral Overfitting in Noisy Linear Probing of Pretrained Representations

    Mar 2, 2026Zice Wang, Zhenyu ZhangNoisy LabelsOverfitting

  42. Training-free LLM Verification via Recycling Few-shot Examples

    Jun 8, 2025Dongseok Lee, Jimyung Hong, Dongyoung Kim +1Training-FreeOverfitting

  43. Benign Overfitting with Quantum Kernels

    Mar 21, 2025Joachim Tomasi, Sandrine Anthoine, Hachem KadriQuantum KernelsOverfitting

  44. Universality of Benign Overfitting in Binary Linear Classification

    Jan 17, 2025Ichiro Hashimoto, Stanislav Volgushev, Piotr ZwiernikOverfittingEmpirical Risk Minimization