Second-Order Optimization

Latest papers 63

All topics
CardsList
  1. Accelerating SAV-based optimization via randomized low-rank Hessian approximation

    Jun 9, 2026Ryo Sagawa, Daisuke Furihata, Yuto MiyatakeOptimization Convergence AnalysisSecond-Order Optimization

  2. Spectral Scaling Laws of Muon

    Jun 2, 2026Gagik Magakyan, Pablo Parrilo, Asuman OzdaglarNewton-Schulz IterationMomentum Methods

  3. Rethinking Bregman Divergences in Kronecker-Factored Optimizers

    May 30, 2026Bing Liu, Wenjie Zhou, Chengcheng ZhaoSecond-Order OptimizationAdaptive Gradient Methods

  4. Exploiting weight-space symmetries for approximating curvature

    May 30, 2026Artem Artemev, Rui Xia, Benjamin M. Boyd +4Neural Network OptimizationSecond-Order Optimization

  5. Revisiting Zeroth-Order Hessian Approximation: A Single-Step Policy Optimization Lens

    May 29, 2026Junbin Qiu, Zhaowei Hong, Renzhe Xu +1Zeroth-Order OptimizationSecond-Order Optimization

  6. Geometry-Correct Diffusion Posterior Sampling with Denoiser-Pullback Curvature Guidance and Manifold-Aligned Damping

    May 27, 2026Seunghyeok Shin, Minwoo Kim, Dabin Kim +1Gauss-Newton OptimizationBayesian Inverse Problems

  7. Real-Time Auto-Optimization in Unknown Environments via Structure-Exploiting Dual Control for Exploration and Exploitation

    May 21, 2026Shiying Dong, Haoyang Yang, Qiwei Liu +1Second-Order OptimizationOptimal Control

  8. AMO: Operator-level Adaptive Muon Orthogonalization

    May 18, 2026Xinlin Zhuang, Panyi Ouyang, Yichen Li +7Language Model PretrainingNewton-Schulz Iteration

  9. Runtime-Orchestrated Second-Order Optimization for Scalable LLM Training

    May 15, 2026Yishun Lu, Junhao Zhang, Zeyu Yang +1Second-Order OptimizationLLM Training

  10. A Non-Monotone Preconditioned Trust-Region Method for Neural Network Training

    May 14, 2026Andrea Angino, Bindi Çapriqi, Shega Likaj +2Neural Network OptimizationSecond-Order Optimization

  11. Error whitening: Why Gauss-Newton outperforms Newton

    May 11, 2026Maricela Best McKay, Nathan P. Lawrence, Brian Wetton +1Gauss-Newton OptimizationDeep Learning Optimization

  12. Optimality of Sub-network Laplace Approximations: New Results and Methods

    May 9, 2026Swarnali Raha, Kshitij Khare, Rohit K PatraBayesian Neural NetworksUncertainty Quantification

  13. Convergence Analysis of Newton's Method for Neural Networks in the Overparameterized Limit

    May 8, 2026Konstantin Riedl, Konstantinos Spiliopoulos, Justin SirignanoNeural Network OptimizationSpectral Bias

  14. Pro-KLShampoo: Projected KL-Shampoo with Whitening Recovered by Orthogonalization

    May 7, 2026Ruotong Sun, Ermin WeiLanguage Model PretrainingDeep Learning Optimization

  15. Fast Gauss-Newton for Multiclass Cross-Entropy

    May 7, 2026Mikalai Korbit, Mario ZanonGauss-Newton OptimizationNeural Network Optimization

  16. Layerwise LQR for Geometry-Aware Optimization of Deep Networks

    May 5, 2026Simon Dufort-Labbé, Pierre-Luc Bacon, Razvan Pascanu +2Deep Learning OptimizationSecond-Order Optimization

  17. A second-order method landing on the Stiefel manifold via Newton\unicodex2013\unicode{x2013}Schulz iteration

    May 4, 2026Xinhui Xiong, Bin Gao, P. -A. AbsilNewton-Schulz IterationStiefel Manifold Optimization

  18. Gradient Regularized Newton Boosting Trees with Global Convergence

    May 1, 2026Nikita Zozoulenko, Daniel Falkowski, Thomas Cass +1Gradient-Boosted Decision TreesOptimization Convergence Analysis

  19. Inference of Online Newton Methods with Nesterov's Accelerated Sketching

    Apr 25, 2026Haoxuan Wang, Xinchen Du, Sen NaStochastic ApproximationSecond-Order Optimization

  20. Shape of Memory: a Geometric Analysis of Machine Unlearning in Second-Order Optimizers

    Apr 24, 2026Kennon StewartSecond-Order OptimizationMachine Unlearning

  21. Lightweight Geometric Adaptation for Training Physics-Informed Neural Networks

    Apr 16, 2026Kang An, Chenhao Si, Shiqian Ma +1Neural Network OptimizationSecond-Order Optimization

  22. DASH: Faster Shampoo via Batched Block Preconditioning and Efficient Inverse-Root Solvers

    Feb 2, 2026Ionut-Vlad Modoranu, Philip Zmushko, Erik Schultheis +2Deep Learning OptimizationGPU Acceleration

  23. Turbo-Muon: Almost-Orthogonal Pre-Conditioning for Fast Muon Updates

    Dec 4, 2025Thibaut Boissin, Thomas Massena, Franck Mamalet +1Newton-Schulz IterationNeural Network Optimization

  24. Understanding and Improving Shampoo and SOAP via Kullback-Leibler Minimization

    Sep 3, 2025Wu Lin, Scott C. Lowe, Felix Dangel +3Deep Learning OptimizationNeural Network Optimization