Flat Minima

Momentum

7 papers in the last four weeks, with none the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 55

All topics
CardsList
  1. Removing spurious minima for planar features by skip connections

    Oct 1, 2026Jakob Paul Zimmermann, Moritz Grillo, Andrei Balakin +1Flat MinimaSkip

  2. Q-MINO: A Minimal-Norm Method for Quantization-Aware Training

    Sep 30, 2026Don LiQuantization-Aware TrainingFlat Minima

  3. Local-Minimum Escaper: Programmatic Subgoal Generation for Robust Navigation in Unknown Environments

    Sep 30, 2026Yin Gu, Xinming Zhang, Shanze Wang +2Robot NavigationObject Goal Navigation

  4. Precise Convergence Speed of Clipped SGD

    Sep 24, 2026David A. R. RobinGradient DescentConvergence

  5. Scalable Minimum-Volume Simplex Estimation with Non-asymptotic Analysis

    Sep 22, 2026Jun LI, Yanlong Guo, Zhaozhao ZengSimplexOptimal Sample Complexity

  6. Teacher Geometry Shapes Learnability in Teacher-Student Networks

    Sep 10, 2026Kai J. Sandbrink, Flavio Martinelli, Alexander van Meegen +2Two-Layer Neural NetworksTeacher

  7. No Unique Minimizer, No Problem: On the Consistency of Robust Neural Classifiers

    Aug 9, 2026Subhabrata Majumdar, Anand Deo, Partha Pratim Saha +1Empirical Risk MinimizationCross-Entropy Losses

  8. Unifying quantum measurement constructions via a relative-entropy minimum change principle

    Aug 4, 2026Nana Liu, Mark M. WildeFlat MinimaPrinciples

  9. From Perturbation Correction to Geometry-Aware Sampling: Sharpness-Guided Equilibrium Sampling for Balanced Flat Minima in Long-Tailed Learning

    Jul 24, 2026Jiaxin Deng, Junbiao PangSharpness-Aware MinimizationBalanced Learning

  10. Deep Reinforcement-Learning-Guided Model Predictive Control for Preventing Overtakes in Autonomous Racing

    Jul 23, 2026Yufei Xi, Yijie Liao, Tulga ErsalAutonomous RacingModel Predictive Control

  11. TRIM: Reducing AI-Generated CodeSlop via Agent Trajectory Minimization

    Jul 20, 2026Alex Mathai, Shobini Iyer, Aleksandr Nogikh +4Code GenerationCode Optimization

  12. How to Build Marcus's Algebraic Mind: From Minsky's Emotion-Machine Viewpoint

    Jul 18, 2026Hiroyuki Chuma, Kanji Otsuka, Yoichi SatoCognitive ScienceReasoning Traces

  13. Scaling Limits of Constant-Stepsize SGD at Flat Minima

    Jul 17, 2026Jingyi Zhang, Cheng Mao, Debankur MukherjeeStochastic Gradient DescentStep Accuracy

  14. Dynamics of Gradient Descent with Large Step Size Near a Manifold of Flat Minima

    Jul 9, 2026Lachlan Ewen MacDonald, René VidalGradient DescentHessian

  15. Smooth %\%MinMax: A Differentiable Relaxation for Codon Harmonization

    Jul 4, 2026Yoonho Jeong, Hyunwoo Choi, Ryan Fernandez Medina Hariri +3Feature AlignmentFlat Minima

  16. Improving Sparse-View 3DGS Generalization via Flat Minima Optimization

    Jul 1, 2026Kangmin Seo, Sangeek Hyun, MinKyu Lee +1Sparse-ViewNovel View Synthesis

  17. Minimizing Quantized Semantic Age of Information (QSAoI) in Foundation Model-Based Semantic Communications

    Jun 30, 2026Huanyu Zhang, Yulin Hu, Xiaopeng Yuan +2Semantic CommunicationsSource-Channel Coding

  18. Local-Minima-Preserving Continuous Relaxation of Ising Problems

    Jun 29, 2026Debraj Banerjee, Santanu Mahapatra, Kunal N. ChaudhurySpatial Photonic Ising MachinesConvex Relaxation

  19. Closed-Form Steepest Descent Direction toward Flat Minima: Reducing Upper Bounds on the Loss Hessian Eigenspectrum in Neural Networks

    Jun 27, 2026Yuto Omae, Kazuki Sakai, Yohei Kakimoto +3HessianGradient Descent

  20. Geometry-Aware Online Scheduling for LLM Serving: From Theoretical Bound to System Practice

    Jun 21, 2026Li Kong, Qi Qi, Yinyu Ye +1Large Language Model ServingSchedulers

  21. Fisher-Geometric Sharpness and the Implicit Bias of SGD toward Flat Minima

    Jun 18, 2026Md Sakir Ahmed, Kumaresh Sarmah, Hemen DuttaStochastic Gradient DescentSharpness-Aware Minimization

  22. Functional Gradient Descent with Adaptive Representations

    Jun 15, 2026Daniel Csillag, Rodrigo Schuller, Pedro Dall'Antonia +3Gradient DescentConvex Loss

  23. Squeeze-Release: Iterative Pruning with Exact Structural Minimization

    Jun 12, 2026Roman Denkin, Ida Akerholm, Prashant Singh +1Unstructured PruningBatch Normalization

  24. Local Search on Vertex Coloring for Bipartite Graphs

    Jun 8, 2026Johanna GasseLarge Neighborhood SearchAcyclic Graphs

  25. Learning-Augmented Online Minimization with Dual Predictions

    Jun 3, 2026Christian Coester, Alexa Tudose, Alexander TuroczyLearning-Augmented AlgorithmsFlat Minima

  26. A Geometric Characterization of the Stationary Plateau for Two-Layer Neural Networks

    Jun 3, 2026Tian Ding, Dawei Li, Ruoyu SunTwo-Layer Neural NetworksAnisotropic Loss Landscapes

  27. Doing well with less! On Sampling Techniques for Empirical Pairwise Loss Estimation/Minimization

    Jun 1, 2026Louise Davy, Stephan Clémençon, Charlotte LaclauOptimal Sample ComplexityLoss Function

  28. Entropy Minimization without Model Collapse: Mitigating Prediction Bias in Medical Imaging

    Jun 1, 2026Tim Nielen, Sameer Ambekar, Johannes Kiechle +2Stable Test-Time AdaptationTest-Time Adaptation

  29. Inconsistency-Aware Minimization: Improving Generalization with Unlabeled Data

    May 29, 2026Hee-Sung Kim, Hyeonseong Kim, Sungyoon LeeUnlabeled DataFlat Minima

  30. Towards the Connection between Activation Sparsity and Flat Minima

    May 25, 2026Ze Peng, Jian Zhang, Lei Qi +2SparsityModern Deep Networks

  31. PMF-CL: Pareto-Minimal-Forgetting Continual Learner for Conflicting Tasks

    May 18, 2026Srijith Nair, Atilla Eryilmaz, Jia LiuReplay-Based Continual LearningCatastrophic Forgetting

  32. Proximal basin hopping: global optimization with guarantees

    May 18, 2026Guillaume Lauga, Cesare Molinari, Samuel VaiterProximal OperatorsFlat Minima

  33. Navigating Potholes with Geometry-Aware Sharpness Minimization

    May 15, 2026Simon Dufort-Labbé, Mehrab Hamidi, Razvan Pascanu +3Sharpness-Aware MinimizationFlat Minima

  34. Don't Stop Me Yet: Sampling Loss Minima via Dissipative Riemannian Mechanics

    May 14, 2026Albert Kjøller Jacobsen, Leo Uhre Jakobsen, Johanna Marie Gegenfurtner +1ReparameterizationFlat Minima

  35. Revisiting Policy Gradients for Restricted Policy Classes: Escaping Myopic Local Optima with kk-step Policy Gradients

    May 11, 2026Alex DeWeese, Guannan QuPolicy GradientOptimal Policies

  36. On the global convergence of gradient descent for wide shallow models with bounded nonlinearities

    May 11, 2026Romain Petit, Clarice Poon, Gabriel PeyréGradient DescentFlat Minima

  37. Select-then-differentiate: Solving Bilevel Optimization with Manifold Lower-level Solution Sets

    May 9, 2026Saeed Masiha, Zebang Shen, Negar Kiyavash +1Bilevel OptimizationFlat Minima

  38. An Interpretable and Scalable Framework for Evaluating Large Language Models

    May 7, 2026Xinhao Qu, Qiang Heng, Hao Zeng +1Large Language Model EvaluationItem Response Theory

  39. Super-Level-Set Regression: Conditional Quantiles via Volume Minimization

    May 7, 2026Sacha Braun, Michael I. Jordan, Francis BachQuantile RegressionConditional Distribution

  40. Backdoor Mitigation in Object Detection via Adversarial Fine-Tuning

    May 7, 2026Kealan Dunnett, Reza Arablouei, Dimity Miller +2Clean Label Backdoor AttackObject Detection

  41. Predicting missing values: A good idea?

    May 5, 2026Stef van BuurenImputationMissing Data

  42. When Flat Minima Fail: Characterizing INT4 Quantization Collapse After FP32 Convergence

    Apr 16, 2026Marcus ArmstrongPost-Training QuantizationQuantizer

  43. Decentralized SGD with Controlled Disagreement Finds Flatter Minima

    Feb 2, 2026Zesen Wang, Mikael JohanssonDecentralized LearningStochastic Gradient Descent

  44. Comparison of D-Wave Quantum Annealing and Gibbs Monte Carlo for Sampling from a Probability Distribution of a Restricted Boltzmann Machine

    Aug 13, 2025Abdelmoula El-Yazizi, Yaroslav KoshkaQuantum AnnealingMonte Carlo

  45. A Morse-Bott Framework for Blind Inverse Problems: Local Recovery Guarantees and the Failure of the MAP

    Aug 4, 2025Minh-Hai Nguyen, Edouard Pauwels, Pierre WeissBayesian Inverse ProblemsGaussian Deblurring

  46. Temporal horizons in forecasting: a performance-learnability trade-off

    Jun 4, 2025Pau Vilimelis Aceituno, Jack William Miller, Noah Marti +2Autoregressive ModelDynamical Systems

  47. Favorability of Loss Landscape with Weight Decay Requires Both Large Overparametrization and Initialization

    May 28, 2025Etienne Boursier, Matthew Bowditch, Matthias Englert +1Anisotropic Loss LandscapesOverparameterization

  48. Minimisation of Quasar-Convex Functions Using Random Zeroth-Order Oracles

    May 4, 2025Amir Ali Farzin, Yuen-Man Pun, Philipp Braun +1NonconvexZeroth-Order