Learning Rates

Recent momentum

-21%

11 papers in the last 28 days · 0.3% of indexed attention

Twelve weeks of publication activity for this topic as it is defined today.

Weekly history

Recent digests

What was published in this topic, kept on the site without email delivery.

Period ending 2026-09-14

6 new papers

A weekly snapshot of new work published in Learning Rates.

Period ending 2026-09-07

3 new papers

A weekly snapshot of new work published in Learning Rates.

94 papers

Latest in Learning Rates

Open your feed →
CardsList
  1. Equivariance Breaks the Learning Rate

    Sep 8, 2026Andrei Manolache, Mathias NiepertAdamEquivariance

  2. Stochastic Optimization of Tree Tensor Networks

    Sep 1, 2026Marius Willner, Maximilian Scharf, André Uschmajew +2Tensor NetworksNeural Network Optimization

  3. Deriving Scaling Laws for OpenEuroLLM Models: Learning Rate, Batch Size and Loss

    Aug 28, 2026Niccolò Ajroldi, Diana Alexandra Onutu, Haider Al-Tahan +4Learning RatesBatch Size

  4. A Rate Separation for Agnostic Direct Sums

    Aug 7, 2026Mihir More, Aritra Das, Debayan GuptaLearning RatesSuperposition

  5. Hyperball May Not Be a Free Lunch

    Jul 24, 2026Yihao Xiao, Jialong Sun, Zitian Gao +5Learning RatesAdaptive Optimizers

  6. Index SLM Technical Report

    Jul 10, 2026Lusheng Zhang, Shien He, Tianxing Yan +5InstructionLearning Rates

  7. Optimal Learning Rate Scaling Depends on Data in Deep Scalar Linear Networks

    Jul 8, 2026Yedi Zhang, Peter E. Latham, Leena Chennuru Vankadara +1Learning RatesScaling Laws

  8. Smooth Scaling Laws Hide Stepwise Token Learning

    Jun 29, 2026Pingjie Wang, Zechen Hu, Peiru Yang +2Scaling LawsLearning Rates

  9. The Hidden Power of Scaling Factor in LoRA Optimization

    Jun 11, 2026Zicheng Zhang, Haoran Li, Jiaxing Wang +10Learning RatesScaling

  10. Anytime Training with Schedule-Free Spectral Optimization

    May 21, 2026Anuj Apte, Pranav Deshpande, Niraj Kumar +2Learning RatesAdam