Scaling Laws

Recent momentum

+14%

16 papers in the last 28 days · 0.3% of indexed attention

Twelve weeks of publication activity for this topic as it is defined today.

Weekly history

Recent digests

What was published in this topic, kept on the site without email delivery.

Period ending 2026-09-21

4 new papers

A weekly snapshot of new work published in Scaling Laws.

Period ending 2026-09-14

4 new papers

A weekly snapshot of new work published in Scaling Laws.

Period ending 2026-09-07

6 new papers

A weekly snapshot of new work published in Scaling Laws.

141 papers

Latest in Scaling Laws

Open your feed →
CardsList
  1. SGD in Multiclass Logistic Regression: Sequential Learning and Scaling Laws

    Sep 7, 2026Konstantinos Christopher Tsiolis, Denny Wu, Christos Thrampoulidis +1Multiclass ClassificationScaling Laws

  2. Deriving Scaling Laws for OpenEuroLLM Models: Learning Rate, Batch Size and Loss

    Aug 28, 2026Niccolò Ajroldi, Diana Alexandra Onutu, Haider Al-Tahan +4Learning RatesBatch Size

  3. Rules or Character? Scaling Laws for AI Safety Design

    Aug 13, 2026Satoshi Takahashi, Nobuji Kouno, Masaaki Komatsu +1Artificial Intelligence SafetySafety

  4. Small-Scale Experiments: Are We There Yet?

    Aug 12, 2026Nicholas Lourie, Kyunghyun Cho, Karen Ullrich +1Scaling LawsHyperparameter Optimization

  5. Skaling: Chinchilla's Exponents Meet Kaplan's Coupling

    Aug 7, 2026Mathurin Videau, Badr Youbi-Idrissi, David Lopez-Paz +1Scaling LawsExponents

  6. Bridging Compute- and Data-Optimal Pretraining

    Jul 28, 2026Tian Qin, Kimia Hamidieh, David Alvarez-MelisScaling LawsBest-Epoch Metrics

  7. Optimal Learning Rate Scaling Depends on Data in Deep Scalar Linear Networks

    Jul 8, 2026Yedi Zhang, Peter E. Latham, Leena Chennuru Vankadara +1Learning RatesScaling Laws

  8. The FIL Hypothesis: Inductive Biases Help with Kernel Engineering

    Jun 29, 2026Nikolai Rozanov, Subhabrata Dutta, Preslav Nakov +1Inductive BiasHypothesis

  9. A Stochastic--Geometric Theory of Scaling Laws in Grokking

    Jun 29, 2026Róisín Luo, Christian Gagné, Jonas Ngnawé +2GrokkingScaling Laws

  10. Smooth Scaling Laws Hide Stepwise Token Learning

    Jun 29, 2026Pingjie Wang, Zechen Hu, Peiru Yang +2Scaling LawsLarge Models

  11. Internal Data Repetition Destroys Language Models

    Jun 23, 2026Jessica Chudnovsky, Joshua Kazdan, Noam Levi +6RepetitionScaling Laws