Neural Network Optimization

Momentum

11 papers in the last four weeks, up 175% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 92

All topics
CardsList
  1. Neural Algorithmic Reasoning for Graph Saddle Point Problems

    Oct 5, 2026Samantha Chen, Jesse He, Coleman Clougherty +2Neural SolversNeural Network Optimization

  2. Muon Is Theoretically Wrong For Convolutions, But Empirically Effective

    Oct 5, 2026Thibaut Boissin, Thomas Massena, Mathieu Serrurier +1MuonNeural Network Optimization

  3. Learning Pareto Stationary Fronts via Single-Pass Backpropagation

    Oct 5, 2026Elina Rojin Celik, Marcos Medeiros Raimundo, Isabel ValeraMulti--Task LearningNeural Network Optimization

  4. Bayesian Optimization in Sequence-to-Architecture Latent Space for Zero-Shot NAS

    Oct 5, 2026Ondrej Tybl, Lukas NeumannNeural Architecture SearchBayesian Neural Networks

  5. Trust the Direction, Search the Step: Zero-and-First-Order Methods for LLM Fine-Tuning

    Oct 1, 2026Cristian McGee, El Houcine Bergou, Aritra DuttaZeroth-Order OptimizationZeroth-Order

  6. SoftServe: A Scalable Quasi-Newton Method for Deep Learning

    Oct 1, 2026Joohwan Ko, Tetiana Parshakova, Diana Cai +1Neural Network OptimizationNewton

  7. MiLoop: Selective Memory Propagation for Neural Combinatorial Optimization

    Oct 1, 2026Changliang Zhou, Yuanyao Chen, Rongsheng Chen +2Neural Combinatorial OptimizationNeural Network Optimization

  8. DCEmbed: Scalable Optimization over Neural Surrogates

    Sep 27, 2026Akshay Sreekumar, Nicolas Christianson, Priya L. Donti +2Neural Network OptimizationStochastic Optimization

  9. On the second-order optimization for spiking neural networks

    Sep 24, 2026Ngoc Phu Doan, Ihsen AlouaniSpiking Neural NetworksTime-To-First-Spike

  10. KATOsuper: Surrogate-accelerated neural topology optimization with sensitivity-consistent Fourier neural operators

    Sep 23, 2026Shengyu Yan, Jasmin JelovicaTopology OptimizationFourier Neural Operators

  11. AURA: Angular Update Rate Adaptation for training complex-valued neural networks

    Sep 22, 2026Enrico Ballini, Allan Peter Engsig-Karup, Tito AndriolloNeural Network OptimizationStep Accuracy

  12. HyCO: A Hybrid Neural Solver for Combinatorial Optimization

    Sep 7, 2026Yuheng Li, Di Yang, Haipeng Chen +1Neural Combinatorial OptimizationNeural Solvers

  13. Stochastic Optimization of Tree Tensor Networks

    Sep 1, 2026Marius Willner, Maximilian Scharf, André Uschmajew +2Tensor NetworksNeural Network Optimization

  14. Momentum as Residual-Driven Multiplier Correction for Deep Learning Optimization

    Aug 13, 2026Zhixin Ren, Yau Lyu, Congrong Li +2Neural Network OptimizationMomentum

  15. Finding the Needle in a Haystack: Test-Time Analog Circuit Representation Adaptation for Bayesian Optimization

    Aug 13, 2026Fin Amin, Sounak Dutta, Paul D. FranzonBayesian OptimizationAnalog Design

  16. Accelerated Learning of High Dimensional Functions with a Tensor-Featured Training Network

    Aug 11, 2026Karl Pierce, Yuehaw Khoo, Haizhao YangTensor DecompositionHigh-Dimensional

  17. Geometric Self-Supervised Pre-training for Neural Combinatorial Optimization

    Jul 31, 2026David Aguado, Daniel Fuertes, Carlos R. del-Blanco +1Neural Combinatorial OptimizationNeural Network Optimization

  18. Which Hyperparameters Matter? A Game-Theoretic Framework for Interpretable Hyperparameter Sensitivity Analysis

    Jul 17, 2026Nyi Nyi Aung, Heepeom Shin, Abigail Lawlor +1HyperparameterShapley Value

  19. Advancing Optimal Subset Oracle via Learning Relaxation of Neural Set Functions

    Jul 13, 2026Yongquan Shi, Zijing Ou, Shiping Wang +1Variational InferenceSurrogate Gradient

  20. An optimal control approach for neural network architecture adaptation with a posteriori error estimation

    Jul 8, 2026C G Krishnanunni, Thomas Scott, Tan Bui-ThanhNeural ApproximationsNeural Network Optimization

  21. The Anatomy of Implicit Bias: Information Allocation in Neural Network Training

    Jul 8, 2026Zhang Gongyue, Wang Zhiyong, Liu Donghan +3Neural Network OptimizationOptimizer Design

  22. Unified convergence analysis for gradient descent optimization methods in the training of deep neural networks

    Jul 5, 2026Shokhrukh Ibragimov, Arnulf JentzenNeural Network OptimizationGradient Descent

  23. Optimality-Informed Neural Networks for Lunar Landing Trajectory Optimization

    Jul 2, 2026Zhenbo WangIntent-Aligned Autonomous Spacecraft GuidanceOptimal Control

  24. Neural Certificate Pricing for Combinatorial Optimization Problems

    Jul 1, 2026Jingyi Chen, Xinyuan Zhang, Xinwu QianNeural Combinatorial OptimizationCombinatorial Optimization

  25. GPU Parallelization Strategies for Forward and Backward Propagation in Shallow Neural Networks: A CUDA-Based Comparative Study

    Jun 29, 2026Rania Zitouni, Nadine Bousdjira, Sarah Hasnaoui +2CudaCpu-Gpu Hybrid Designs

  26. Bilevel Optimization for Neural Architecture Search

    Jun 28, 2026Abhishek Shukla, Ankur Sinha, Faiz HamidBilevel OptimizationNeural Architecture Search

  27. SOAP-Bubbles: Structured Weight Uncertainty for Neural Networks

    Jun 22, 2026Adrian Robert Minut, Nico Daheim, Marco Miani +3Bayesian Neural NetworksNeural Network Optimization

  28. Provably Sub-Linear Two-Timescale NeuroEvolution with Online Plasticity

    Jun 18, 2026Shishen Lin, Yixin ChenNeuroevolutionLearning-Based Control

  29. eCNNTO: A Highly Generalizable ConvNet for Accelerating Topology Optimization

    Jun 18, 2026Shengbiao Lu, Xiaodong WeiTopology OptimizationFinite Element Method

  30. Deep-Unfolded Coordination

    Jun 18, 2026Hunter Kuperman, Minchan Jung, Rahul V. Ghosh +2Deep Unfolding NetworksNeural Network Optimization

  31. Interpreting Neural Combinatorial Optimization via Evolving Programmatic Bottlenecks

    Jun 18, 2026Haocheng Duan, Yuxin Guo, Jieyi Bi +4Neural Combinatorial OptimizationConcept Bottleneck Models

  32. Schattor: Schatten-family methods for deep learning optimization

    Jun 14, 2026Bohao Ma, Junyu Zhang, Chuan HeNeural Network OptimizationStochastic Optimization

  33. Different Layers, Different Manifolds: Module-Wise Weight-Space Geometry in Transformer Optimization

    Jun 11, 2026Kirato YoshiharaTransformer AttentionManifolds

  34. Accelerating SAV-based optimization via randomized low-rank Hessian approximation

    Jun 9, 2026Ryo Sagawa, Daisuke Furihata, Yuto MiyatakeHessianNewton

  35. Beyond the Thin-Layer Limit: Differentiable Volumetric Training for Visible-Range Diffractive Neural Networks

    Jun 5, 2026Dineth Jayakody, Dushan N. WadduwageModern Deep NetworksDifferentiable Optimization

  36. LLM-Guided ANN Index Optimization for Human-Object Interaction Retrieval

    Jun 3, 2026Shahrzad Esmat, Chaunte W. Lacewell, Sameh Gobriel +2RetrieversGeneral Grid Search Framework

  37. Multi-Column RBF Neural Network Using Adaptive and Non-Adaptive Particle Swarm Optimization

    Jun 3, 2026Ammar Hoori, Yuichi MotaiRadial Basis FunctionParticle Swarm Optimization

  38. Beyond Static Priors: Dynamic Neural Guidance for Large-Scale Ant Colony Optimization

    Jun 2, 2026Dat Thanh Tran, Van Khu Vu, Yining MaNeural Combinatorial OptimizationParticle Swarm Optimization

  39. Regularized Large Neighborhood Search

    Jun 1, 2026Germain Vivier-Ardisson, Laurent Demonet, Axel Parmentier +1Neural Combinatorial OptimizationLarge Neighborhood Search

  40. SparseOpt: Addressing Normalization-induced Gradient Skew in Sparse Training

    May 26, 2026Mohammed Adnan, Rohan Jain, Tom Jacobs +4Batch NormalizationNeural Network Optimization

  41. EMA-Nesterov: Stabilizing Nesterov's Lookahead for Accelerated Deep Learning Optimization

    May 25, 2026Chung-Yiu Yau, Dawei Li, Athanasios Glentis +3Momentum Stochastic Gradient DescentNeural Network Optimization

  42. Optimization of randomized neural networks for transfer operator approximation

    May 22, 2026Mohammad Tabish, Stefan KlusNeural ApproximationsNeural Network Optimization

  43. Non-normal spectral signatures of instability in neural network training dynamics

    May 22, 2026Souvik GhoshNeural Network OptimizationDeep Network

  44. Hinge Regression Trees and HRT-Boost: Newton-Optimized Oblique Learning for Compact Tabular Models

    May 22, 2026Hongyi Li, Jun Xu, Hong YanDecision TreesTabular Learning

  45. WeCon: An Efficient Weight-Conditioned Neural Solver for Multi-Objective Combinatorial Optimization Problems

    May 20, 2026Xuan Wu, Jinbiao Chen, Yang Li +7Neural Combinatorial OptimizationNeural Solvers

  46. StableGrad: Backward Scale Control without Batch Normalization

    May 19, 2026Jose I. Mestre, Alberto Fernández-Hernández, Cristian Pérez-Corral +2Batch NormalizationNeural Network Optimization

  47. Scale-Invariant Neural Network Optimization: Norm Geometry and Heavy-Tailed Noise

    May 18, 2026Jiayu Zhang, Tianyi LinNeural Network OptimizationSpectral Norm

  48. An Amortized Efficiency Threshold for Comparing Neural and Heuristic Solvers in Combinatorial Optimization

    May 14, 2026Sohaib AfifiNeural Combinatorial OptimizationCombinatorial Optimization

  49. NeuroRisk: Physics-Informed Neural Optimization for Risk-Aware Traffic Engineering

    May 13, 2026Yingming Mao, Ximeng Liu, Jingyi Cheng +8Bringing Network CodingNeural Network Optimization

  50. Implicit Neural Optimal Transport via Fixed-Point Optimization

    May 11, 2026Yesom Park, Eric Gelphman, Stanley Osher +1Neural Network OptimizationPrimal-Dual Methods