Stochastic Optimization Convergence

Latest papers 141

All topics
CardsList
  1. Factor Augmented High-Dimensional SGD

    May 19, 2026Shubo Li, Yuefeng Han, Xiufan YuStochastic OptimizationStochastic Optimization Convergence

  2. Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise

    May 18, 2026Jiayu Zhang, Tianyi LinStochastic OptimizationNeural Network Optimization

  3. High-dimensional Limit of SGD for Diagonal Linear Networks

    May 16, 2026Begoña García Malaxechebarría, Courtney Paquette, Maryam Fazel +1Stochastic Optimization ConvergenceNeural Network Training Dynamics

  4. Adam-SHANG: A Convergent Adam-Type Method for Stochastic Smooth Convex Optimization

    May 13, 2026Yaxin Yu, Long Chen, Minfu FengStochastic OptimizationMomentum Methods

  5. Constrained Stochastic Spectral Preconditioning Converges for Nonconvex Objectives

    May 12, 2026Konstantinos Oikonomidis, Jan Quan, Kimon Antonakopoulos +3Nonconvex Stochastic OptimizationMuon Optimizer

  6. Phases of Muon: When Muon Eclipses SignSGD

    May 10, 2026Elliot Paquette, Noah Marshall, Lucas Benigni +3Sign-Based OptimizationMuon Optimizer

  7. Adversary-Robust Learning from Fully Asynchronous Directional Derivative Estimates

    May 10, 2026Anik Kumar Paul, Nibedita Roy, Nagesh Talagani +3Stochastic OptimizationSign-Based Optimization

  8. \mathsf{VISTA}: Decentralized Machine Learning in Adversary Dominated Environments

    May 8, 2026Hanzaleh Akbari Nodehi, Parsa Moradi, Soheil Mohajer +1Mechanism DesignByzantine-Robust Federated Learning

  9. Robust stochastic first order methods in heavy-tailed noise via medoid mini-batch gradient sampling

    May 8, 2026Manojlo Vukovic, Dusan JakoveticStochastic OptimizationNonconvex Stochastic Optimization

  10. SGD for Variational Inference: Tackling Unbounded Variance via Preconditioning and Dynamic Batching

    May 8, 2026Hippolyte Labarrière, Cesare Molinari, Silvia Villa +1Stochastic Optimization ConvergenceVariational Inference

  11. Locally Near Optimal Piecewise Linear Regression in High Dimensions via Difference of Max-Affine Functions

    May 7, 2026Haitham Kanj, Kiryung LeeGradient DescentSample Complexity

  12. When and Why SignSGD Outperforms SGD: A Theoretical Study Based on ℓ1\ell_1-norm Lower Bounds

    May 7, 2026Hongyi Tao, Dingzhi Yu, Lijun ZhangSign-Based OptimizationOptimization Convergence Analysis

  13. Directional Consistency as a Complementary Optimization Signal: The GONO Framework

    May 7, 2026Victor Daniel GeraDeep Learning OptimizationStochastic Optimization Convergence

  14. Accelerating LMO-Based Optimization via Implicit Gradient Transport

    May 7, 2026Won-Jun Jang, Si-Hyeon LeeMuon OptimizerStochastic Optimization Convergence

  15. On Adaptivity in Zeroth-Order Optimization

    May 5, 2026Hassan Dbouk, Nidham Gazagnadou, Matthias Reisser +1Zeroth-Order OptimizationLLM Fine-Tuning

  16. Robust and Fast Training via Per-Sample Clipping

    May 4, 2026Davide Nobile, Philipp GrohsGradient ClippingNonconvex Stochastic Optimization

  17. Bringing Order to Asynchronous SGD: Towards Optimality under Data-Dependent Delays with Momentum

    May 3, 2026Tehila Dahan, Roie Reshef, Sharon Goldstein +1Momentum MethodsDistributed Optimization

  18. High-Probability Convergence in Decentralized Stochastic Optimization with Gradient Tracking

    Apr 30, 2026Aleksandar Armacki, Haoyuan Cai, Ali H. SayedConvergence AnalysisStochastic Optimization Convergence

  19. From Cursed to Competitive: Closing the ZO-FO Gap via Input-to-State Stability

    Apr 28, 2026Amir Ali Farzin, Philipp Braun, Iman ShamesZeroth-Order OptimizationStochastic Optimization Convergence

  20. A unified convergence theory for adaptive first-order methods in the nonconvex case, including AdaNorm, full and diagonal AdaGrad, Shampoo and Muo

    Apr 19, 2026S. Gratton, Ph. L. TointMomentum MethodsNonconvex Stochastic Optimization

  21. Lower Bounds and Proximally Anchored SGD for Non-Convex Minimization Under Unbounded Variance

    Apr 17, 2026Arda Fazla, Ege C. Kaya, Antesh Upadhyay +1Stochastic OptimizationNonconvex Stochastic Optimization