Spectral Norm

Momentum

13 papers in the last four weeks, up 117% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 86

All topics
CardsList
  1. A Simple Doxastic Deontic Logic for Norm-Guided Decision Making

    Sep 30, 2026Thorsten Engesser, Agata CiabattoniEthicsDecisions

  2. Benign Overfitting for General Norms and Distributions

    Sep 27, 2026Daniel Barzilai, Ohad ShamirOverfittingSpectral Norm

  3. Nuclear Norm-Regularized Bayesian Matrix Completion

    Sep 24, 2026Calvin TolbertTensor CompletionMatrix

  4. Simpler Methods Work Better for L1 Penalized Logistic Models and Large Datasets

    Sep 21, 2026Edward Raff, James HoltSpectral NormSolvers

  5. Tail-Weight Control and Localized Generalization in Nearly Low-Rank Adversarial Classification

    Sep 20, 2026Kunyu Wang, Dehan Wang, Wenjun ChenAdversarial TrainingAdversarial Examples

  6. Stable Movement for Nondual Lipschitz Convex Optimization: Efficiency and Nearly Optimal Oracle Rates

    Sep 17, 2026David Martínez-Rubio, Cristóbal GuzmánConvex OptimizationLipschitz Continuity

  7. The First-Order Oracle Complexity of Lipschitz Convex Optimization in Nondual Settings

    Sep 17, 2026David Martínez-Rubio, Brian Bullins, Cristóbal Guzmán +1Convex OptimizationLipschitz Continuity

  8. On the Regularization Landscape for the Linear Recommendation Models

    Sep 12, 2026Dong Li, Zhenming Liu, Ruoming Jin +4Real-World Content Recommendation ProblemLow-Rank Structure

  9. Structured Transforms for Low-Overhead Quantization of Language Models

    Sep 11, 2026Daria Cherniuk, Alexander Rudikov, Boris Kashin +1Large Language Model QuantizationModel Weights

  10. Optimal Low-Rank Quantum State Tomography with Bounded-Sample Joint Measurements

    Sep 9, 2026Ashwin Nayak, Xingyu ZhouQubitOptimal Sample Complexity

  11. Oracle Complexity of Stochastic Fixed-Point Equations with Nonexpansive Maps

    Sep 8, 2026Jelena Diakonikolas, Cristóbal Guzmán, David Martínez-RubioFirst Order Oracle ComplexityFixed-Point Iteration

  12. Restricted Eigenvalues Beyond Gaussian Width: Threshold Occupancy under Heavy Tails

    Sep 3, 2026Shi Fu, Huibo Xu, Qixin Zhang +1Non-GaussianityLong-Tailed Distribution

  13. Intrinsic Interaction Geometry Controls the Low-Rank Complexity of Softmax Attention

    Aug 28, 2026Yuhe Sui, Jianing Zhang, Yingzhi TangLow-Rank StructureSpectral Norm

  14. Toward a First-Principles Update Geometry for the Language-Model Head

    Aug 23, 2026Aditya Somasundaram, Charles Guille-Escuret, Alexander Moreno +2Spectral NormMulti-Head Attention

  15. Sparse and robust geometric twin support vector machine via asymmetric RoBoSS loss function

    Aug 12, 2026Kai Qi, Xinji Huang, Hongchun WangSupport Vector MachinesLoss Function

  16. Sharpness-Aware Minimization and Muon: Robustness under the Spectral Norm

    Jul 28, 2026Wenzhi Zhong, Edward Milsom, Michael MurraySharpness-Aware MinimizationRegularization

  17. Beyond a Global Norm: Personalizing Toxicity Sensitivity in Language Models Without Retraining

    Jul 25, 2026Rares A. C. Diaconescu, Iulia Slanina, Alina Florea +5ToxicityHarmful Language

  18. Concentration and Mean-Square Bounds for Contractive Stochastic Approximation: A Unified Elementary Approach

    Jul 20, 2026Siddharth ChandakStochastic ApproximationConcentration Bounds

  19. Muse: Representation Geometry of Muon Beyond Normalized Momentum

    Jul 16, 2026Da Chang, Qiankun Shi, Lvgang Zhang +4MuonRepresentation Space

  20. Spectral Concentration and Recovery in Sparse High-Dimensional Random Geometric Graphs

    Jul 15, 2026Manuel Fernandez, Yizhe ZhuInhomogeneous Random GraphsDiscriminative Congruence Transform

  21. NormGuard: Reward-Preserving Norm Constraints in Flow-Matching Reinforcement Learning

    Jun 26, 2026Tianlin Pan, Lianyu Pang, Cheng Da +4Reinforcement Fine-TuningNorm

  22. The Decision Geometry of Covariance Estimation for the Global Minimum-Variance Portfolio under Heavy Tails

    Jun 25, 2026Xavier FonsecaPortfolio OptimizationCovariance

  23. Tensorion: A Tensor-Aware Generalization of the Muon Optimizer

    Jun 24, 2026Vladimir Bogachev, Vladimir Aletov, Alexander Molozhavenko +2AdamMuon

  24. Improving Neural Network Training by Decoupling the Magnitude and Direction of Weight Vectors

    Jun 24, 2026Alexander Hägele, Alejandro Hernández-Cano, Atli Kosson +1Adaptive OptimizersDecoupling

  25. Low-Rank Tensor Completion Based on Fractional Regularization with Ky Fan p-k Norm

    Jun 17, 2026Shan Fan, Feng Zhang, Jianjun Wang +2Tensor CompletionLow-Rank Structure

  26. Generalization Guarantees for Multi-Input Neural Operator Learning in Sobolev Spaces

    Jun 16, 2026Yahong Yang, Zecheng Zhang, Wei Zhu +2Probabilistic Operator LearningLogarithmic Sobolev Inequalities

  27. Sobolev Approximation by Fixed-Size Neural Networks with Arbitrary Accuracy

    Jun 15, 2026Baicheng Li, Haizhao Yang, Shijun ZhangNeural ApproximationsLogarithmic Sobolev Inequalities

  28. Schattor: Schatten-family methods for deep learning optimization

    Jun 14, 2026Bohao Ma, Junyu Zhang, Chuan HeNeural Network OptimizationStochastic Optimization

  29. Free Heavy-Tailed Lunch for Muon: A Theoretical Justification of Empirical Success

    Jun 12, 2026Florian Hübler, Thomas Pethick, Suvrit SraSpectral NormMuon

  30. Geometric Domain Adaptation via Optimal Transport for Linear Regression in R^2

    Jun 12, 2026Brian Britos, Mathias BourelDomain AdaptationSpectral Norm

  31. The Tell-Tale Norm: ℓ2\ell_2 Magnitude as a Signal for Reasoning Dynamics in Large Language Models

    Jun 4, 2026Jinyang Zhang, Hongxin Ding, Yue Fang +4LLM Reasoning StrategiesL2

  32. Measuring Model Robustness via Fisher Information: Spectral Bounds, Theoretical Guarantees, and Practical Algorithms

    Jun 3, 2026Chong Zhang, Xiang Li, Jia Wang +2Robustness VerificationFisher Information Matrix

  33. Improved Distribution Estimation in ℓ∞\ell_\infty

    May 28, 2026Doron Cohen, Aryeh Kontorovich, Yonatan LivshitzConcentration BoundsDistributionally-Robust Optimization

  34. From SGD to Muon: Adaptive Optimization via Schatten-p Norms

    May 19, 2026Thomas Massena, Corentin Friedrich, Mathieu SerrurierOptimizer DesignMuon

  35. Optimal Reconstruction from Linear Queries

    May 19, 2026Yuval Filmus, Shay Moran, Elizaveta NesterovaReconstruction ErrorO(\Bar{K}\Log N)$

  36. Going PLACES: Participatory Localized Red Teaming for Text-to-Image Safety in the Global South

    May 18, 2026Charvi Rastogi, Mukul Bhutani, Minsuk Kahng +13Multilingual SafetyRed-Teaming

  37. Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise

    May 18, 2026Jiayu Zhang, Tianyi LinNeural Network OptimizationSpectral Norm

  38. GQA-μP: The maximal parameterization update for grouped query attention

    May 14, 2026Kyle R. Chickering, Huijuan Wang, Mengxi Wu +7Model WeightsParameter-Efficient Fine-Tuning Methods

  39. Gradient Clipping Beyond Vector Norms: A Spectral Approach for Matrix-Valued Parameters

    May 12, 2026Alexander Yukhimchuk, Mladen Kolar, Martin Takáč +1Gradient ClippingStochastic Gradient Descent

  40. Muon is Not That Special: Random or Inverted Spectra Work Just as Well

    May 11, 2026Zakhar Shumaylov, Nathaël Da Costa, Peter Zaika +6MuonSpectral Norm

  41. Intrinsic Muon: Spectral Optimization on Riemannian Matrix Manifolds

    May 10, 2026Yibang Li, Bihari Lal Pandey, Ravi Sah +4MuonRiemannian Optimization

  42. OrScale: Orthogonalised Optimization with Layer-Wise Trust-Ratio Scaling

    May 8, 2026Yuxuan Lou, Yang YouSpectral NormScaling

  43. Fortifying Time Series: DTW-Certified Robust Anomaly Detection

    May 8, 2026Shijie Liu, Tansu Alpcan, Christopher Leckie +1Time-Series Anomaly DetectionTime Series

  44. Disagreement-Regularized Importance Sampling for Adversarial Label Corruption

    May 8, 2026Csongor Horváth, Ida-Maria Sintorn, Prashant SinghNoisy LabelsImportance

  45. QuadNorm: Resolution-Robust Normalization for Neural Operators

    May 8, 2026Bum Jun Kim, Makoto Kawano, Yusuke Iwasawa +1Batch NormalizationNeural Operators

  46. Sample Complexity of Stochastic Optimization with Integer Variables

    May 8, 2026Hongyu Cheng, Yinghao Zheng, Marco Molinaro +1Stochastic OptimizationOptimal Sample Complexity

  47. When and Why SignSGD Outperforms SGD: A Theoretical Study Based on ℓ1\ell_1-norm Lower Bounds

    May 7, 2026Hongyi Tao, Dingzhi Yu, Lijun ZhangStochastic Gradient DescentSignsgd

  48. Optimal Confidence Band for Kernel Gradient Flow Estimator

    May 7, 2026Yuqian Cheng, Zhuo Chen, Qian LinConfidence IntervalsWasserstein Gradient Flows