Sharpness-Aware Minimization

Momentum

7 papers in the last four weeks, up 133% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 63

All topics
CardsList
  1. Sharpening Tax in Post-Training

    Oct 1, 2026Changdae Oh, Qi Zeng, Qi Qi +7Reinforcement Learning Post-TrainingPost-Training

  2. Sharpen Before You Adapt: Data-Free Entry-State Sharpening for Test-Time Reinforcement Learning

    Oct 1, 2026Zhanming Zhang, Vinoth SelvendranIntermediate CheckpointsSharpness-Aware Minimization

  3. Propagate, Then Sharpen: Post-Hoc Refinement of Frozen Node Classifiers

    Sep 28, 2026Preben Johnsen Bentdal, Nello Blaser, Xue-Cheng TaiPropagationSharpness-Aware Minimization

  4. Sharpness-Aware Minimization (SAM) Improves Classification Accuracy of Bacterial Raman Spectral Data Enabling Portable Diagnostics

    Sep 16, 2026Kaitlin Zareno, Jarett Dewbury, Siamak K. Sorooshyari +2RamanAntimicrobial Peptide

  5. Stochastic Gradient Descent over P2

    Sep 11, 2026Maria Oprea, Qin Li, Yunan YangStochastic Gradient DescentStochastic Differential Equations

  6. Explaining f-Divergence-Based Regularization via Local Curvature and Sharpness-Aware Minimization

    Sep 8, 2026Nour Jamoussi, Marios KountourisSharpness-Aware MinimizationLocal Curvature

  7. Sharpening the Ensemble: An SSIM-Aligned Residual Refiner for Brain-MRI Inpainting Post-Processing

    Sep 3, 2026Kubilay Kağan Kömürcü, İlkay ÖksüzMagnetic Resonance ImagingInpainting

  8. A Compositional Theory of Curvature in Probabilistic Circuits

    Aug 13, 2026Hrithik Suresh, Sahil Sidheekh, Shelar Parth Vijay +3Sharpness-Aware MinimizationProbabilistic Model

  9. FaithIR: Rethinking Infrared Image Super-Resolution from Perceptual Sharpness to Task Relevant Fidelity

    Aug 4, 2026Axi Niu, Zhenguo Wu, Kang Zhang +3Hyperspectral Image Super-ResolutionReconstruction Fidelity

  10. Level, Sharpness, and Corpus: Why Zero-Shot OOD Detector Rankings Do Not Transfer

    Jul 29, 2026Ignacio M. De la Jara, Cristian Rodriguez-Opazo, Stephen Gould +1Out-Of-Distribution DetectionIn-Distribution

  11. Sharpness-Aware Minimization and Muon: Robustness under the Spectral Norm

    Jul 28, 2026Wenzhi Zhong, Edward Milsom, Michael MurraySharpness-Aware MinimizationRegularization

  12. When Can You Correct Distribution Drift in Temporal Graph Generation? A Sharpening--Drift Tension and an Impossibility for Observation-Based Correction

    Jul 27, 2026Tianpeng Li, Xuan Guo, Wenjun Wang +2Temporal Graph Neural NetworksGenerative Flow Networks

  13. Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations

    Jul 25, 2026Junho So, Dongwook ShinStochastic Gradient DescentSharpness-Aware Minimization

  14. From Perturbation Correction to Geometry-Aware Sampling: Sharpness-Guided Equilibrium Sampling for Balanced Flat Minima in Long-Tailed Learning

    Jul 24, 2026Jiaxin Deng, Junbiao PangSharpness-Aware MinimizationBalanced Learning

  15. Gradient-Energy Guided Block-Wise Perturbations for Sharpness-Aware Minimization

    Jul 17, 2026Zhen Huang, Jiaxin Deng, Junbiao PangSharpness-Aware MinimizationLocal Curvature

  16. BCG-Former: Toward Pareto-Efficient Hyperspectral Image Classification via Band-Contextual Gating

    Jul 17, 2026Gaurav Sharma, Eungjoo LeeHyperspectral ImageCnn-Transformer Tradeoff

  17. Sharper Analysis of Single-Loop Methods for Bilevel Optimization

    Jul 11, 2026Yubo Zhou, Jun Shu, Luo Luo +4Bilevel OptimizationConvergence

  18. Dynamics of Gradient Descent with Large Step Size Near a Manifold of Flat Minima

    Jul 9, 2026Lachlan Ewen MacDonald, René VidalGradient DescentHessian

  19. Leveraging Extragradient for Effective Sharpness-Aware Minimization in Deep Learning

    Jul 7, 2026Yao Fu, Chunxia Zhang, Junmin Liu +3Stochastic Gradient DescentSharpness-Aware Minimization

  20. SAMPLe: SAM-based Optimizer for Prompt Learning in VLMs

    Jul 7, 2026Hossein Rajoli, Fatemeh Lotfi, Niloufar Alipour Talemi +3Multiple Prompt Learning FrameworksVision-Language Model Adaptation

  21. FedFFT: Taming Client Drift in Federated SAM via Spectral Perturbation Filtering

    Jul 5, 2026Liyang Yuan, Yibo Yang, Dandan GuoFederated LearningFrequency Domain

  22. Directional Curvature from Armijo Backtracking: A Low-Cost Sharpness Probe and a Calibration-Free Learning-Rate Safeguard for Adam

    Jul 4, 2026Ashmitha R, Jörg FrochteAdamSharpness-Aware Minimization

  23. Don't Let Gains FADE: Breaking Down Policy Gradient Weights in RL

    Jul 1, 2026Juliette Decugis, Sean O'Brien, Francis Bach +2Sharpness-Aware Minimization

  24. How Far Can Sharpness and Complexity Jointly Explain Generalization?

    Jun 27, 2026Ziyu Cheng, Xitong Zhang, Longxiu Huang +1Sharpness-Aware MinimizationOverparameterization

  25. Recovering Sharp Conductivity Features in the Finite-Data Calderón Problem with Physics-Informed Neural Networks

    Jun 26, 2026Ali AlHadi Kalout, Pablo Tejerina-Pérez, Konstantin Karchev +5Parametric Physics-Informed Neural NetworkPhysics-Informed Learning

  26. Certification of Machine Learning Models via Directional Sharpness

    Jun 23, 2026Gefei Tan, Adria Gascon, Sarah Meiklejohn +1CertificationSharpness-Aware Minimization

  27. TALAS: Teacher-Anchored Layer Alignment with Adaptive Sharpness-Aware Minimization for Embedding Distillation

    Jun 20, 2026Quoc Phong Dao, Hoang Son Nguyen, Pham Khanh Chi +4Knowledge DistillationDistributional Alignment

  28. Fisher-Geometric Sharpness and the Implicit Bias of SGD toward Flat Minima

    Jun 18, 2026Md Sakir Ahmed, Kumaresh Sarmah, Hemen DuttaStochastic Gradient DescentSharpness-Aware Minimization

  29. 5% > 100%: Flatness Preference is All You Need for Multimodal Parameter-Efficient Fine-Tuning

    Jun 9, 2026Yifan Zhu, Can Lin, Hangjie Yuan +4Parameter-Efficient Fine-Tuning MethodsModel Fine-Tuning

  30. Improving the sharpness in neural network-based parametric post-processing of ensemble forecasts

    Jun 7, 2026Ágnes Baran, Máté MihalinaNumerical Weather PredictionPost-Processing

  31. Adaptive Sharpness-Aware Minimization with a Polyak-type Step size: A Theory-Grounded Scheduler

    Jun 1, 2026Dimitris Oikonomou, Nicolas LoizouStochastic Gradient DescentSharpness-Aware Minimization

  32. Confidence-Adaptive SwiGLU for Mixture-of-Experts

    May 30, 2026Shaohua Li, Xiuchao Sui, Xiaobing Sun +4Mixture-Of-ExpertsGating

  33. Self-Consistency via Marginal Sharpening

    May 27, 2026Aleksei Arzhantsev, Otmane Sakhi, Nicolas ChopinInference-TimeReasoning Skills

  34. Rethinking Gradient Modulation in Multimodal Regression

    May 26, 2026Haojie Yin, Chengcheng Feng, Tianyi Liu +2OphthalmologyOptical Coherence Tomography

  35. A Sharper Picture of Generalization in Transformers

    May 20, 2026Paul Lintilhac, Sair ShaikhGeneralization BoundsSharpness-Aware Minimization

  36. DASM: Domain-Aware Sharpness Minimization for Multi-Domain Voice Stream Steganalysis

    May 19, 2026Pengcheng Zhou, Pianran Guo, Shuhua Chen +3SteganographySharpness-Aware Minimization

  37. Graph Transductive Sharpening: Leveraging Unlabeled Predictions in Node Classification

    May 18, 2026Brown Zaz, Mar Gonzàlez I Català, Ferran Hernandez Caralt +2Transductive LearningUnlabeled Data

  38. Navigating Potholes with Geometry-Aware Sharpness Minimization

    May 15, 2026Simon Dufort-Labbé, Mehrab Hamidi, Razvan Pascanu +3Sharpness-Aware MinimizationFlat Minima

  39. Deep Image Segmentation via Discriminant Feature Learning

    May 14, 2026Adam Dawid Sztamborski, Raül Pérez-Gonzalo, Antonio AgudoImage ClassificationFeature Pyramid

  40. Sharpen Your Flow: Sharpness-Aware Sampling for Flow Matching

    May 12, 2026Aditi Gupta, Soon Hoe Lim, Annan Yu +1Conditional Flow MatchingAccelerated Sampling

  41. SLASH the Sink: Sharpening Structural Attention Inside LLMs

    May 11, 2026Yiming Liu, Bin Lu, Xinbing Wang +2Concept Bottleneck ModelsSharpness-Aware Minimization

  42. Fix the Loss, Not the Radius: Rethinking the Adversarial Perturbation of Sharpness-Aware Minimization

    May 11, 2026Jinping Wang, Qinhan Liu, Zhiwu Xie +1Sharpness-Aware MinimizationApproximate Nearest-Neighbor Search

  43. FedVSSAM: Mitigating Flatness Incompatibility in Sharpness-Aware Federated Learning

    May 9, 2026Bingnan Xiao, Yuan Gao, Bingcong Li +3Federated LearningSharpness-Aware Minimization

  44. Sharper Guarantees for Misspecified Kernelized Bandit Optimization

    May 7, 2026Davide Maran, Csaba SzepesváriKernel MethodBandits

  45. LIVEditor-14B: Lightning Unified Video Editing via In-Context Sparse Attention

    May 6, 2026Shitong Shao, Zikai Zhou, Haopeng Li +4Dynamic Sparse AttentionVideo Editing

  46. Sharpness-Aware Pretraining Mitigates Catastrophic Forgetting

    May 4, 2026Ishaan Watts, Catherine Li, Sachin Goyal +2Catastrophic ForgettingPost-Training

  47. SGD at the Edge of Stability: The Stochastic Sharpness Gap

    Apr 22, 2026Fangshuo Liao, Afroditi Kolomvaki, Anastasios KyrillidisStochastic Gradient DescentSharpness-Aware Minimization

  48. Too Sharp, Too Sure: When Calibration Follows Curvature

    Apr 22, 2026Alessandro Morosini, Matea Gjika, Tomaso Poggio +1Sharpness-Aware MinimizationDeep Network

  49. Generalization at the Edge of Stability

    Apr 21, 2026Mario Tuci, Caner Korkmaz, Umut Şimşekli +1Generalization BoundsSharpness-Aware Minimization

  50. Beyond Distribution Sharpening: The Importance of Task Rewards

    Apr 17, 2026Sarthak Mittal, Leo Gagnon, Guillaume LajoieDistributional Reinforcement LearningSharpness-Aware Minimization

  51. Multigrain-aware Semantic Prototype Scanning and Tri-Token Prompt Learning Embraced High-Order RWKV for Pan-Sharpening

    Apr 16, 2026Junfeng Li, Wenyang Zhou, Xueheng Li +3Fine-Grained PerceptionConvolutional

  52. Non-Euclidean Gradient Descent Operates at the Edge of Stability

    Mar 5, 2026Rustem Islamov, Michael Crawshaw, Jeremy Cohen +1Gradient DescentGradient

  53. Do Flat Minima Improve Sparse Novel View Synthesis?

    Nov 22, 2025Youngsik Yun, Dongjun Gu, Youngjung UhNovel View SynthesisSparse-View