Loss Landscape Geometry

Momentum

5 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 19

All topics
CardsList
  1. Optimization Geometry of QAOA and Variational Quantum Algorithms

    Oct 4, 2026Vojtěch Novák, Ivan Zelinka, Silvie Illésová +2Quantum Approximate Optimization AlgorithmVariational Quantum Algorithms

  2. Misalignment of Low-Loss Regions Causes Grokking

    Sep 30, 2026Yongding Tian, Zaid Al-Ars, Maksim Kitsak +1Loss Landscape GeometryGrokking

  3. How Does Local Landscape Geometry Evolve in Language Model Pre-Training?

    Sep 30, 2026Zhanpeng Zhou, Yuhan Sun, Bingrui Li +4Language Model PretrainingLearning Rate Scheduling

  4. Benign Loss Landscapes Can Coexist with Worst-Case Hardness

    Sep 14, 2026Zach Furman, Stephan Wäldchen, Yangda Bei +1Tensor NetworksStatistical Learning Theory

  5. Teacher Geometry Shapes Learnability in Teacher-Student Networks

    Sep 10, 2026Kai J. Sandbrink, Flavio Martinelli, Alexander van Meegen +2Neural Network OptimizationNeural Network Training Dynamics

  6. Fisher-Geometric Sharpness and the Implicit Bias of SGD toward Flat Minima

    Jun 18, 2026Md Sakir Ahmed, Kumaresh Sarmah, Hemen DuttaInformation GeometryImplicit Bias

  7. Why Muon Outperforms Adam: A Curvature Perspective

    Jun 3, 2026Shuche Wang, Fengzhuo Zhang, Jiaxiang Li +2Neural Network OptimizationMuon Optimizer

  8. A Geometric Characterization of the Stationary Plateau for Two-Layer Neural Networks

    Jun 3, 2026Tian Ding, Dawei Li, Ruoyu SunNeural Network OptimizationLoss Landscape Geometry

  9. Exploiting weight-space symmetries for approximating curvature

    May 30, 2026Artem Artemev, Rui Xia, Benjamin M. Boyd +4Neural Network OptimizationSecond-Order Optimization

  10. Worker Disagreement Reveals Sharp Directions in Local SGD

    May 26, 2026Tolga Dimlioglu, Kristi Topollai, Anna ChoromanskaNeural Network Training DynamicsLoss Landscape Geometry

  11. Model Merging on Loss Landscape: A Geometry Perspective

    May 26, 2026Juanwu Lu, Anand Bhaskar, Brian Axelrod +2Task Vector MergingModel Merging

  12. Navigating Potholes with Geometry-Aware Sharpness Minimization

    May 15, 2026Simon Dufort-Labbé, Mehrab Hamidi, Razvan Pascanu +3Sharpness-Aware MinimizationFlat Minima

  13. The Role of Symmetry in Optimizing Overparameterized Networks

    Apr 28, 2026Kusha Sareen, Mohammad Pedramfar, Sékou-Oumar Kaba +2Neural Network OptimizationWeight-Space Analysis

  14. Curvature-Aligned Probing for Local Loss-Landscape Stabilization

    Apr 16, 2026Nikita Kiselev, Andrey GrabovoyNeural Network OptimizationNeural Network Training Dynamics

  15. Temporal horizons in forecasting: a performance-learnability trade-off

    Jun 4, 2025Pau Vilimelis Aceituno, Jack William Miller, Noah Marti +2Long-Term Time Series ForecastingTime Series Forecasting

  16. Favorability of Loss Landscape with Weight Decay Requires Both Large Overparametrization and Initialization

    May 28, 2025Etienne Boursier, Matthew Bowditch, Matthias Englert +1Weight DecayNeural Network Initialization