Sparse Attention

Momentum

24 papers in the last four weeks, up 200% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 160

All topics
CardsList
  1. Veda: Scalable Video Diffusion via Distilled Sparse Attention

    May 28, 2026Shihao Han, Hao Yang, Xinting Hu +3Video Diffusion ModelsDiffusion Transformer

  2. OSP-Next: Efficient High-Quality Video Generation with Sparse Sequence Parallelism, HiF8 Quantization, and Reinforcement Learning

    May 27, 2026Yunyang Ge, Xianyi He, Zezhong Zhang +4Video Diffusion ModelsText-to-Video Generation

  3. Inference Time Context Sparsity: Illusion or Opportunity?

    May 22, 2026Sahil Joshi, Prithvi Dixit, Agniva Chowdhury +5LLM Inference EfficiencyStructured Sparsity

  4. Structured-Sparse Attention for Entity Tracking with Subquadratic Sequence Complexity

    May 21, 2026Hangyue Zhao, Paul Caillon, Erwan Fagnou +1Self-AttentionStructured Sparsity

  5. EntmaxKV: Support-Aware Decoding for Entmax Attention

    May 20, 2026Gonçalo Duarte, Miguel Couceiro, Marcos V. TrevisoSelf-AttentionKV Caching

  6. LT2: Linear-Time Looped Transformers

    May 20, 2026Chunyuan Deng, Yizhe Zhang, Rui-Jie Zhu +4Efficient Transformer InferenceRecurrent Transformers

  7. RoPeSLR: 3D RoPE-driven Sparse-LowRank Attention for Efficient Diffusion Transformers

    May 20, 2026Yuxi Liu, Zekun Zhang, Yixiang Cai +3Rotary Positional EmbeddingsLow-Rank Attention

  8. Efficient Long-Context Modeling in Diffusion Language Models via Block Approximate Sparse Attention

    May 19, 2026Wenhu Zhang, Yiming Wu, Huanyu Wang +6Self-AttentionLong-Context Language Modeling

  9. DashAttention: Differentiable and Adaptive Sparse Hierarchical Attention

    May 18, 2026Yuxiang Huang, Nuno M. T. Gonçalves, Federico Alvetreti +5Self-AttentionLong-Context Modeling

  10. SparseSAM: Structured Sparsification of Activations in Segment Anything Models

    May 17, 2026Hoai-Chau Tran, Chi H. Nguyen, Duy M. H. Nguyen +3Efficient Transformer InferenceImage Segmentation

  11. CompactAttention: Accelerating Chunked Prefill with Block-Union KV Selection

    May 16, 2026Jiwon Song, Dongwon Jo, Beomseok Kang +1Self-AttentionKV-Cache Management

  12. From Sparsity to Simplicity: Enabling Simpler Sequential Replacements via Sparse Attention Distillation

    May 15, 2026Yuxin Ren, Maxwell D Collins, Miao Hu +1Self-AttentionVision Transformer

  13. STS: Efficient Sparse Attention with Speculative Token Sparsity

    May 15, 2026Ceyu Xu, Jiangnan Yu, Yongji Wu +1Self-AttentionLong-Context Language Model Inference

  14. HASTE: Training-Free Video Diffusion Acceleration via Head-Wise Adaptive Sparse Attention

    May 14, 2026Xuzhe Zheng, Yuexiao Ma, Jing Xu +3Video Diffusion ModelsDiffusion Transformer

  15. TurboVGGT: Fast Visual Geometry Reconstruction with Adaptive Alternating Attention

    May 14, 2026David Huang, Guile Wu, Chengjie Huang +23D ViTsMulti-View 3D Reconstruction

  16. Do Vision Transformers Need All-to-All Attention? Global Communication Through Elastic Learned Cores

    May 12, 2026Alan Z. Song, Yinjie Chen, Mu Nan +3Visual Representation LearningVision Transformer

  17. Learning Subspace-Preserving Sparse Attention Graphs from Heterogeneous Multiview Data

    May 12, 2026Jie Chen, Yuanbiao Gou, Chuanbin Liu +2Graph Structure LearningMulti-View Learning

  18. An Efficient Hybrid Sparse Attention with CPU-GPU Parallelism for Long-Context Inference

    May 8, 2026Feiyu Yao, Zhixiong Niu, Xiaqing Li +3GPU AccelerationSelf-Attention

  19. Sparse Attention as a Range Searching Problem: Towards an Inference-Efficient Index for KV Cache

    May 7, 2026Mohsen Dehghankar, Abolfazl AsudehSelf-AttentionKV Caching

  20. LIVEditor-14B: Lightning Unified Video Editing via In-Context Sparse Attention

    May 6, 2026Shitong Shao, Zikai Zhou, Haopeng Li +4Video EditingIn-Context Learning