Neural Network Generalization

Latest papers 204

All topics
CardsList
  1. Tunneling the Loss Landscape: Bypassing Memorization with Monte Carlo Parameter Swapping

    Aug 3, 2026Lai Shun Chan, Xiaotian Zhang, Yue Shang +2Neural Network GeneralizationMarkov Chain Monte Carlo

  2. On the robustness of noisy solutions in non-convex neural networks

    Jul 29, 2026Enrico M. Malatesta, Alessandra Passalacqua, Riccardo ZecchinaStochastic OptimizationNeural Network Generalization

  3. More Data, Worse Decisions? Preference Reversals in Neural Networks under Gram Incompatibility

    Jul 28, 2026Yanli Yan, Yuanzheng Li, Yong Zhao +2Neural Network GeneralizationNeural Representation Geometry

  4. Mechanisms of Width Scaling in Normalized Residual Networks: The Effective Alignment Dimension

    Jul 27, 2026Jinhao Zhang, Zeyu Liu, Zicheng Yan +4Neural Network GeneralizationResidual Learning

  5. Grokking on the Weight-Decay Clock: A Rate Hierarchy from Softly Broken Symmetries

    Jul 27, 2026Taeyoung KimNeural Network GeneralizationWeight Decay

  6. A Statistical Difference between Single-Layer Learning and Hierarchical Learning in Wide Neural Networks

    Jul 26, 2026Sumio WatanabeNeural Network GeneralizationHierarchical Representation Learning

  7. Cautious optimism for deep parameterized quantum circuits

    Jul 23, 2026Marie Kempkes, Elies Gil-Fuster, Carlos Bravo-Prieto +5Double DescentNeural Network Generalization

  8. Requential Coding: Pushing the Limits of Model Compression with Self-Generated Training Data

    Jul 13, 2026Shikai Qiu, Marc Finzi, Yujia Zheng +2Model CompressionNeural Network Generalization

  9. Random Label Prediction Heads for Studying Memorization in Deep Neural Networks

    Jul 13, 2026Marlon Becker, Jonas Konrad, Luis Garcia Rodriguez +1Neural Network GeneralizationNeural Network Memorization

  10. Emergent Generalization by Representation Learning in Artificial Neural Networks

    Jul 11, 2026Hardik Rajpal, Dan GoodmanNeural Network GeneralizationRepresentation Learning

  11. Architecture Generalization with MetaNCA

    Jul 8, 2026Meet Barot, Daniel Berenberg, Sina KhajehabdollahiNeural Cellular AutomataNeural Network Generalization

  12. A Function-Space Dichotomy for Compositional Learning: Exponential Sub-Optimality of the Neural Tangent Kernel

    Jul 7, 2026Arkaprabha Ganguli, Emil ConstantinescuNeural Network GeneralizationKernel Regression

  13. Leveraging Extragradient for Effective Sharpness-Aware Minimization in Deep Learning

    Jul 7, 2026Yao Fu, Chunxia Zhang, Junmin Liu +3Neural Network GeneralizationSharpness-Aware Minimization

  14. Drift Happens: An Empirical Study of Neural Architecture Robustness to Temporal Distribution Shift

    Jul 7, 2026Robin Holzinger, Riccardo CollettiDistribution Shift RobustnessNeural Network Generalization

  15. Broken Ergodicity and the Violation of the Fluctuation-Dissipation Theorem Lead to Generalization Beyond Overfitting in Machine Learning

    Jul 5, 2026Chan Li, Nigel GoldenfeldDouble DescentStatistical Physics of Learning

  16. Statistically Meaningful Geometry (SMG) Beyond the Euclidean Paradigm, with Application to Generative AI

    Jul 3, 2026Bing Cheng, Yi-Shuai Niu, Howell Tong +1Neural Network GeneralizationInformation Geometry

  17. Benign Overfitting Does Not Occur in Diffusion Models

    Jul 2, 2026Tyler Farghly, Benjamin Dupuis, Alain Durmus +1Double DescentNeural Network Generalization

  18. Born Discrete, Made Smooth: Variational Formulation of Shallow Neural Networks

    Jul 2, 2026Matej Benko, Pierre Bousquet, Iwona Chlebicka +1Shallow Neural NetworksNeural Network Generalization

  19. Revisiting the Volume Hypothesis

    Jun 30, 2026Ari Pakman, Lior Kreimer, Yakir BerchenkoNeural Network GeneralizationStochastic Gradient Descent

  20. Informational Frustration in Neural Manifolds: Shannon Bottlenecks and the Limits of Learnability

    Jun 29, 2026Srinivasa Rao P., Vangmayi P ReddyStatistical Physics of LearningNeural Network Generalization

  21. A Stochastic--Geometric Theory of Scaling Laws in Grokking

    Jun 29, 2026Róisín Luo, Christian Gagné, Jonas Ngnawé +2Neural Network GeneralizationNeural Network Optimization

  22. Generalization Analysis of Transformers in Distribution Regression

    Jun 28, 2026Peilin Liu, Ding-Xuan ZhouNeural Network GeneralizationTransformer Attention