Unstructured Pruning

Momentum

9 papers in the last four weeks, against 1 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 43

All topics
CardsList
  1. Better Nearest Neighbor Graph Indices via (Efficient) LLM-Guided Pruning

    Sep 28, 2026Fangzhou Wu, Haike Xu, Sandeep SilwalGraph-Based RetrievalApproximate Nearest-Neighbor Search

  2. Output-aware Residual Stream Pruning for Large Language Models

    Sep 28, 2026Chayne Thrash, Kevin Chen, Soheil KolouriLarge Language Model CompressionUnstructured Pruning

  3. GroupMask: Layer-Adaptive Group-wise Sparsity for Semi-Structured LLM Pruning

    Sep 27, 2026Zhengao Li, Shuoqiu Li, Xiaofang Zhang +7Unstructured PruningLarge Language Model Compression

  4. Artificial Structure Function Search: Preserving Artificial Functional Connectivity for Structured Pruning

    Sep 21, 2026Mindula Illeperuma, Rafael Pina, Charuka Herath +2Unstructured PruningStructured Pruning

  5. Higher-order pruning of experts in mixture-of-experts language models

    Sep 16, 2026Alex M. Tseng, Prannay Kaul, Luca Zancato +2Mixture-Of-Experts Large Language ModelsMixture-Of-Experts

  6. Theoretical Guarantees for One-Shot Magnitude Pruning and Compute-Adaptive Early Exit

    Sep 14, 2026Erdem KoyuncuUnstructured PruningDeep Network

  7. LILA: Calibration-Free Structured Pruning of Large Language Models via Latent Spectral Geometry

    Sep 11, 2026Sankar Behera, Dhruv Singh, Anshika Agnihotri +3Large Language Model CompressionUnstructured Pruning

  8. Forward-Free LLM Depth Pruning via Weight Redundancy

    Sep 9, 2026Vincent-Daniel Yun, Woosang LimUnstructured PruningLarge Language Model Compression

  9. Functional Degeneracy in Neural Networks: Measurement and Pruning

    Aug 31, 2026Maria Matveev, Pascal Esser, Ayush Bharadwaj +2Unstructured PruningNeural Network

  10. Inference-Time Scaling of Diffusion Models via Progressive Seed Pruning

    Jul 23, 2026Rogerio Guimaraes, Pietro PeronaDiffusion ModelsInference-Time

  11. PRISM: Sensitivity-Aware PolynoMial PRuning for EffIcient Neural Network Encryption

    Jul 20, 2026Sahaj Majavdia, Mahdi TaheriHomomorphic EncryptionUnstructured Pruning

  12. WaveNet-Style Guitar Amplifier Model Pruning for Real-Time iOS Deployment

    Jul 11, 2026Ryota Sato, Eli SilversteinUnstructured PruningInstrument

  13. Structured Pruning of Large Language Models via Power Transformation and Sign-Preserving Score Aggregation with Adaptive Feature Retention

    Jul 9, 2026Ryota Kobayashi, Tsubasa Hirakawa, Takayoshi Yamashita +4Unstructured PruningStructured Pruning

  14. Provable Pruning for Efficient 3D Gaussian Splatting via Coresets

    Jul 2, 2026Waseem Mousa, Alaa MaaloufNovel View SynthesisUnstructured Pruning

  15. MVPruner: Dynamic Token Pruning for Accelerating Multi-view Vision-Language Models in Autonomous Driving

    Jun 26, 2026Nan Yang, Zhanwen Liu, Linfeng Zhang +4Visual Token PruningAutonomous Driving

  16. Complementary Attention Head Pruning for Efficient Transformers

    Jun 17, 2026Yaniv Livertovsky, Shahar Somin, Gonen SingerTransformer AttentionUnstructured Pruning

  17. Squeeze-Release: Iterative Pruning with Exact Structural Minimization

    Jun 12, 2026Roman Denkin, Ida Akerholm, Prashant Singh +1Unstructured PruningBatch Normalization

  18. Finding Sparse Subnetworks in One Training Cycle via Progressive Magnitude-Based Pruning

    Jun 10, 2026Romana Qureshi, Hafida Benhidour, Said Kerrache +1Unstructured PruningLotteries

  19. Towards Data-free and Training-free Compression for Speech Foundation Models Using Parameter Clustering

    Jun 10, 2026Haoning Xu, Zhaoqing Li, Huimeng Wang +4Task-Aware CompressionUnstructured Pruning

  20. Beyond FLOPs: Benchmarking Real Inference Acceleration of LLM Pruning under a GEMM-Centric Taxonomy

    Jun 8, 2026Haozhe Hu, Hao Wu, Anhao Zhao +4LLM Inference OptimizationUnstructured Pruning

  21. VEDAL: Variational Error-Driven Asynchronous Learning for 3D Gaussian Splatting Pruning

    Jun 1, 2026Aoduo Li, Jiancheng Li, Huan Ye +5Novel View SynthesisUnstructured Pruning

  22. Neural Network Compression by Approximate Differential Equivalence

    May 31, 2026Ravi Dhiman, Andrea Passarella, Mirco Tribastone +1Compressed ModelNeural Approximations

  23. Structured Neuron Pruning in Deep Neural Networks Using Multi-Armed Bandits

    May 29, 2026Salem Ameen, Sunil VaderaModern Deep NetworksUnstructured Pruning

  24. Joint Model and Data Sparsification via the Marginal Likelihood

    May 28, 2026Alexander Timans, Thomas Möllenhoff, Christian A. Naesseth +2SparsityBayesian Networks

  25. PrunePath: Towards Highly Structured Sparse Language Models

    May 27, 2026Zhexuan Gu, Zixun Fu, Yancheng YuanUnstructured PruningSparsity

  26. Prune, Update and Trim: Robust Structured Pruning for Large Language Models

    May 18, 2026Diego Coello de Portugal Mecke, Tom Hanika, Lars Schmidt-ThiemeUnstructured PruningFeed-Forward

  27. LEAP: Learnable End-to-End Adaptive Pruning of Large Language Models

    May 17, 2026Mohammad Mozaffari, Younes Hourri, Mohammad Rastegari +1Unstructured PruningSparsity

  28. SparseForge: Efficient Semi-Structured LLM Sparsification via Annealing of Hessian-Guided Soft-Mask

    May 7, 2026Liu Hanzuo, Chaofan Lin, Weixuan Sun +4SparsityUnstructured Pruning

  29. Revisiting the Effectiveness of LLM Pruning for Test-Time Scaling

    Apr 28, 2026Ocean Monjur, Shahriar Kabir Nahin, Anshuman ChhabraUnstructured PruningTest-Time Scaling

  30. Supernodes and Halos: Loss-Critical Hubs in LLM Feed-Forward Layers

    Apr 26, 2026Audrey Cherilyn, Houman SafaaiFeed-ForwardUnstructured Pruning

  31. GRASPrune: Global Gating for Budgeted Structured Pruning of Large Language Models

    Apr 21, 2026Ziyang Wang, Jiangfeng Xiao, Chuan Xiao +3Large Language Model CompressionUnstructured Pruning

  32. MOONSHOT : A Framework for Multi-Objective Pruning of Vision and Large Language Models

    Apr 14, 2026Gabriel Afriat, Xiang Meng, Shibal Ibrahim +2Unstructured PruningNeural Network

  33. Garbage Attention in Large Language Models: BOS Sink Heads and Sink-aware Pruning

    Jan 11, 2026Jaewon Sok, Jewon Yeom, Seonghyeon Park +2Large Language Model CompressionUnstructured Pruning

  34. Hyperflux: Pruning Reveals Importance

    Apr 6, 2025Eugen Barbulescu, Antonio Alexoaie, Lucian BusoniuUnstructured PruningStructured Pruning

  35. DarwinLM: Evolutionary Structured Pruning of Large Language Models

    Feb 11, 2025Shengkun Tang, Oliver Sieberling, Eldar Kurtic +2Large Language Model CompressionUnstructured Pruning