Activation Sparsity

Momentum

5 papers in the last four weeks, up 67% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 40

All topics
CardsList
  1. Towards the Connection between Activation Sparsity and Flat Minima

    May 25, 2026Ze Peng, Jian Zhang, Lei Qi +2Efficient Neural Network InferenceActivation Sparsity

  2. Asymmetric Scaling Laws from Sparse Features

    May 22, 2026John Sous, Michael WinerDouble DescentActivation Sparsity

  3. MoASE++: Mixture of Activation Sparsity Experts with Domain-Adaptive On-policy Distillation for Continual Test Time Adaptation

    May 18, 2026Ronyu Zhang, Aosong Cheng, Gaole Dai +8Activation SparsityMixture of Experts

  4. Bug or Feature2^2: Weight Drift, Activation Sparsity and Spikes

    May 17, 2026Egor Shvetsov, Aleksandr Serkov, Shokorov Viacheslav +3ReLU Neural NetworksActivation Sparsity

  5. Uncovering Intra-expert Activation Sparsity for Efficient Mixture-of-Expert Model Execution

    May 9, 2026Jongseok Park, Sunga Kim, Zhenyu Gu +2Activation SparsityMixture-of-Experts Inference

  6. ELAS: Efficient Pre-Training of Low-Rank Large Language Models via 2:4 Activation Sparsity

    May 5, 2026Jiaxi Li, Lu Yin, Li Shen +5Language Model PretrainingActivation Sparsity

  7. When Spike Sparsity Does Not Translate to Deployed Cost: VS-WNO on Jetson Orin Nano

    Apr 18, 2026Jason Yoo, Shailesh Garg, Souvik Chakraborty +1Efficient Neural Network InferenceActivation Sparsity

  8. Sparse but Wrong: Incorrect L0 Leads to Incorrect Features in Sparse Autoencoders

    Aug 22, 2025David Chanin, Adrià Garriga-AlonsoActivation SparsityLLM Interpretability