Matrix Optimization

Momentum

3 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 47

All topics
CardsList
  1. Normalize-Then-Precondition: A Hierarchical Approach to Marginal Scale and Interaction Geometry for LLM Training

    Sep 29, 2026Zixuan Gong, Zeyu Gan, Jiaye Teng +1Language Model PretrainingMatrix Optimization

  2. Optimization over covariance matrices with a parameterized metric

    Sep 15, 2026Yibang Li, Bamdev Mishra, Pratik Jawanpuria +1Riemannian OptimizationSecond-Order Optimization

  3. MOON: Multi-Objective OrthoNormalized Updates for Multitask Learning

    Aug 12, 2026Shiji Zhou, Kunlin Lyu, Lei Zhang +2Neural Network OptimizationMulti-Task Learning

  4. Muon on the Stiefel Manifold Admits an Exact Closed-Form Update

    Aug 6, 2026Mikhail Solonko, Molozhavenko Alexander, Maxim RakhubaStiefel Manifold OptimizationRiemannian Optimization

  5. The Loss Does Not See the Basis, but Adam Does

    Aug 5, 2026Devender SinghLow-Rank Matrix DecompositionMatrix Optimization

  6. Joint Affine Spectral Shaping: Coupling Weight and Bias Updates Beyond Weight-Only Muon

    Aug 4, 2026Gongyue Zhang, Honghai LiuNeural Network OptimizationMuon Optimizer

  7. Graph-Based Correlation Matrix Generation: A Convex Optimization Approach

    Jul 24, 2026Ali Fakhar, K{é}vin Polisano, Ir{è}ne Gannaz +1Matrix OptimizationMatrix Completion

  8. Muse: Representation Geometry of Muon Beyond Normalized Momentum

    Jul 16, 2026Da Chang, Qiankun Shi, Lvgang Zhang +4Representation GeometryMomentum Methods

  9. Graph-Regularized Low-Rank Matrix Completion by Variable Projection

    Jul 10, 2026Benoît Loucheur, P. -A. Absil, Michel JournéeLow-Rank ApproximationMatrix Optimization

  10. Beyond Adam: SOAP and Muon for Faster, Label-Efficient Training of Machine Learning Interatomic Potentials

    Jul 2, 2026Gil Harari, Yoel Zimmermann, Ola Tangen Kulseng +4Machine Learning Interatomic PotentialsNeural Network Optimization

  11. Direction-Magnitude Decomposition for Low-Rank Matrix Optimization: Faster Convergence and Saddle-to-saddle Dynamics

    Jun 30, 2026Yudong Wei, Liang Zhang, Bingcong Li +1Low-Rank Matrix DecompositionNonconvex Optimization

  12. ITSPACE: Monotone Gaussian Optimal Transport Updates

    Jun 29, 2026Woojoo Na, Jennifer DyMatrix OptimizationOptimal Transport

  13. Aurora: A Leverage-Aware Spectral Optimizer

    Jun 26, 2026Alec Dewulf, Dhruv Pai, Li Yang +2Neural Network OptimizationMuon Optimizer

  14. Schattor: Schatten-family methods for deep learning optimization

    Jun 14, 2026Bohao Ma, Junyu Zhang, Chuan HeDeep Learning OptimizationStochastic Optimization Convergence

  15. Free Heavy-Tailed Lunch for Muon: A Theoretical Justification of Empirical Success

    Jun 12, 2026Florian Hübler, Thomas Pethick, Suvrit SraStochastic OptimizationNonconvex Stochastic Optimization

  16. Zeta: Dual Whitening for Matrix Optimization via Coordinate-Adaptive Preconditioning

    Jun 12, 2026Kaiwen Chen, Shuhai Zhang, Zimo Liu +7Neural Network OptimizationMatrix Optimization

  17. Scalable Deep Unfolding of Conic Optimizers

    Jun 11, 2026Alex Oshin, Rahul Vodeb Ghosh, Evangelos A. TheodorouSemidefinite ProgrammingAlgorithm Unrolling

  18. The Spectral Dynamics and Noise Geometry of Muon

    Jun 7, 2026Pierfrancesco Beneventano, Mahmoud Abdelmoneum, Tomaso PoggioMuon OptimizerMatrix Optimization

  19. On solving symmetric multi-type orthogonal non-negative matrix tri-factorization problem

    Jun 6, 2026Rok Hribar, Gregor Papa, Janez Povh +1Non-Negative Matrix FactorizationGraph Clustering

  20. A Nonmonotone Gradient-Based Algorithm for Symmetric Nonnegative Matrix Factorization and Graph Clustering

    Jun 1, 2026Ryan Swart, Johannes BrustNon-Negative Matrix FactorizationGraph Clustering

  21. Riemannian Optimization for Hadamard Products of Low-Rank Matrices

    May 31, 2026Pratik Jawanpuria, Ankish Chandresh, Bamdev MishraRiemannian OptimizationLow-Rank Approximation

  22. Manifold-based Algorithms for the Hadamard Decomposition

    May 27, 2026Nicolas Gillis, Subhayan Saha, Stefano Sicilia +1Low-Rank Matrix DecompositionLow-Rank Approximation

  23. Implicit Regularization in Perturbed Deep Matrix Factorization: Spectral Conditions and Stability

    May 27, 2026Jingzhe Wang, Hung-Hsu ChouAlgorithmic StabilityLow-Rank Matrix Decomposition

  24. An Exterior Method for Nonnegative Matrix Factorization

    May 19, 2026Qiujing Lu, Tonmoy Monsoor, Ehsan Ebrahimzadeh +2Non-Negative Matrix FactorizationLow-Rank Matrix Decomposition

  25. Learning Fill-in Reduction Ordering via Graph Policy Optimization for Sparse Matrices

    May 17, 2026Ziwei Li, Shuzi Niu, Huiyuan Li +2Policy OptimizationMatrix Optimization

  26. Sample-efficient inductive matrix completion with noise and inexact side-information

    May 16, 2026Yuepeng Yang, Cong MaMatrix OptimizationMatrix Completion

  27. Intrinsic Muon: Spectral Optimization on Riemannian Matrix Manifolds

    May 10, 2026Yibang Li, Bihari Lal Pandey, Ravi Sah +4Stiefel Manifold OptimizationRiemannian Optimization

  28. Navigating LLM Valley: From AdamW to Memory-Efficient and Matrix-Based Optimizers

    May 9, 2026Aditya RanganathDeep Learning OptimizationMemory-Efficient Optimization

  29. PolarAdamW: Disentangling Spectral Control and Schur Gauge-Equivariance in Matrix Optimisation

    May 8, 2026Haozhou ZhangMuon OptimizerMatrix Optimization

  30. Muon with Nesterov Momentum: Heavy-Tailed Noise and (Randomized) Inexact Polar Decomposition

    May 7, 2026Sayantan Choudhury, Xiaoran Cheng, Martin Takáč +2Stochastic OptimizationMomentum Methods

  31. Pro-KLShampoo: Projected KL-Shampoo with Whitening Recovered by Orthogonalization

    May 7, 2026Ruotong Sun, Ermin WeiLanguage Model PretrainingDeep Learning Optimization

  32. DiBA: Diagonal and Binary Matrix Approximation for Neural Network Weight Compression

    May 7, 2026Nobutaka OnoEfficient Neural Network InferenceMatrix Optimization

  33. Nora: Normalized Orthogonal Row Alignment for Scalable Matrix Optimizer

    May 5, 2026Jinghui Yuan, Jiaxuan Zou, Shuo Wang +2Neural Network OptimizationMatrix Optimization

  34. Hankel and Toeplitz Rank-1 Decomposition of Arbitrary Matrices with Applications to Signal Direction-of-Arrival Estimation

    Apr 29, 2026Georgios I. OrfanidisLow-Rank Matrix DecompositionDirection-of-Arrival Estimation

  35. State-Dependent Lyapunov Analysis of Rank-1 Matrix Factorization

    Apr 28, 2026Jaehong MoonEdge of StabilityLyapunov Stability

  36. Provably Finding a Hidden Dense Submatrix among Many Planted Dense Submatrices via Convex Programming

    Jan 7, 2026Valentine Olanubi, Phineas Agar, Brendan AmesStochastic Block ModelMatrix Optimization

  37. Ky Fan Norms and Beyond: Dual Norms and Combinations for Matrix Optimization

    Dec 10, 2025Alexey Kravatskiy, Ivan Kozyrev, Nikolai Kozlov +3Deep Learning OptimizationMuon Optimizer

  38. The Optimization Landscape of Carathéodory Decomposition of Toeplitz Covariances

    Nov 3, 2025Daniel Busbib, Ami WieselNonconvex OptimizationMatrix Optimization

  39. Low-rank Orthogonalization for Large-scale Matrix Optimization with Applications to Foundation Model Training

    Sep 15, 2025Chuan He, Zhanwang Deng, Zhaosong LuNeural Network OptimizationLow-Rank Approximation

  40. Doubly Stochastic Adaptive Neighbors Clustering via the Marcus Mapping

    Aug 6, 2024Jinghui Yuan, Chusheng Zeng, Fangyuan Xie +5ClusteringGraph Clustering