Attention Mechanisms

Momentum

42 papers in the last four weeks, up 100% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 378

All topics
CardsList
  1. Ask Self, Ask Others: Relation Is All You Need

    Aug 20, 2026Yuting Ge, Pengju Yang, Mingkai NieSelf-AttentionDecoder-Only Language Models

  2. Attention from Action, for Action: Emergent Visual Bottlenecks for Policy Learning

    Aug 13, 2026Zheyu Zhuang, Ruiyu Wang, Nick Heppert +4Visual AttentionVisuomotor Policy Learning

  3. Lapis: Laplacian Spiking Attention via First-Spike Timing and Membrane Leakage

    Aug 12, 2026Kaiwen Tang, Jiaqi Zheng, Zixuan Zhu +3Spiking TransformersEfficient Attention

  4. PolarSym: Polar Geometry-aware Attention for CAD Floorplan Parsing

    Aug 12, 2026Kerui Chen, Yiqing Wang, Kangzhou Xin +2Panoptic SegmentationTransformer Attention

  5. LoKiFormer: Locality-aware Attention with Decoupled Knowledge Memory for Efficient Large Language Model Pretraining

    Aug 12, 2026Qiuwu Chen, Zimo Liu, Yuchen Li +8Language Model PretrainingMemory-Augmented Language Models

  6. FLARE++: Low-rank attention with dynamic attention routing

    Aug 12, 2026Vedant Puri, Yongjie Jessica Zhang, Levent Burak KaraLow-Rank AttentionPDE Surrogate Modeling

  7. Linearized 2-Simplicial Attention

    Aug 10, 2026Aritra Das, Dhruman Gupta, Debayan GuptaLinear AttentionAttention Mechanisms

  8. Rethinking Attention Locality in Spiking Transformers

    Aug 9, 2026Zeqi Zheng, Zizheng Zhu, Yuping Yan +3Spiking TransformersSpiking Neural Networks

  9. Gated Spatial Redundancy Projection for Pathology Transformer Attentions

    Aug 8, 2026Zhiyuan Yang, Jiahao Cheng, Vincent Quoc-Huy Trinh +1Cancer Survival PredictionSelf-Attention

  10. DoGMA: A Central-Dogma-Guided Foundation Model for Multi-Omics Alignment and Multi-Task Learning in Oncology

    Aug 8, 2026Junfei Ling, Bangzheng Pu, Bingsen Xue +3Cancer Survival PredictionClinical Outcome Prediction

  11. Attention, Anomalies! Handling Attention Layers in Unsupervised Federated Outlier Detection

    Aug 5, 2026Mihailo Ilić, Miloš Savić, Vladimir Kurbalija +3Memory-Augmented Neural NetworksFederated Learning Aggregation

  12. Attention-based representations for multi-task computation

    Aug 4, 2026Daniel Hsu, Mingyue XuRepresentation LearningMulti-Task Learning

  13. When Should Graph Attention Be Sparse? Learning a Per-Edge Tsallis Index

    Aug 3, 2026Kleyton da Costa, Bernardo ModenesiGraph Attention NetworksAttention Mechanisms

  14. TextNCA: Neural Cellular Automata for Language Modeling via Hierarchical Local Attention

    Aug 3, 2026Avni Mittal, Avinash Anand, Ashutosh Kumar +7Neural Cellular AutomataAutoregressive Language Modeling

  15. DART: Decoded Attention over Recurrent States for Efficient Long-Context Sequence Modeling

    Aug 3, 2026Yixiao Qian, Song Chen, Pengkai Wang +3Memory-Augmented Language ModelsKV Caching

  16. ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression

    Jul 31, 2026Yuhang Zhan, Lisi Chen, Shuo ShangSoftmax AttentionKV Caching

  17. A Compositional Theory of Causally Masked Transformers

    Jul 29, 2026Franz Nowak, Ryan Cotterell, Reda BoumasmoudTransformer ExpressivityTransformer

  18. Beyond KV Reconstruction: Functional Reconstruction for MLA Draft Models in Speculative Decoding

    Jul 29, 2026Weiye Shi, Fanxu Meng, Muhan ZhangSpeculative DecodingLLM Inference Acceleration

  19. Intrinsic and Triangulation-Agnostic Attention: A Simple and Powerful Approach for Learning on Meshes

    Jul 27, 2026Ashwath Shetty, Zihan Zhu, Soeren Pirk +13D ViTsGeometric Representation Learning

  20. Self-Attention Dynamics with Rotary Position Embeddings: Twisted States and Explicit Consensus Rates on the Sphere

    Jul 27, 2026Hao YeSoftmax AttentionRotary Positional Embeddings

  21. SpecFormer: Mitigating Embedding and Attention Collapse via Spectral-Aware Transformer for Recommendation

    Jul 27, 2026Yu Cui, Yi Xu, Jiahao Wang +6Representation CollapseTransformer

  22. Variational-Ising-Attention:Tailored Attention Matters for Science

    Jul 26, 2026Rui WangAttention Mechanisms