Attention Mechanisms

Momentum

42 papers in the last four weeks, up 100% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 378

All topics
CardsList
  1. Through the Bottleneck: How Multi-head Latent Attention Separates Content from Position in Language Models

    Jul 25, 2026Dhruvil S, Fenil Sojitra, Ravirajsinh ChauhanTransformer InterpretabilityLow-Rank Attention

  2. What Softmax Throws Away: Mass-Aware Attention for Evidence Accumulation

    Jul 24, 2026Minwoo Yu, Young-guk HaTemporal GNNsTemporal Link Prediction

  3. ELSAA: Efficient Low-Rank and Sparse Attention Approximation for Training Transformers

    Jul 22, 2026Mahdi Heidari, Mohammad Mahdi Rahimi, Jaekyun MoonLow-Rank AttentionTransformer Attention

  4. MoA-Structured Decode Attention DNF Derivation, KV-Cache Accumulation, GQA/MQA, and OpenACC Kernel

    Jul 21, 2026Lenore Mulin, Gaetan HainsEfficient Transformer InferenceGrouped-Query Attention

  5. Breaking Feedback-Blindness: Utility-Augmented Transformer for Sequential Decision Making

    Jul 21, 2026Yuyang Shen, Shan Dai, Daimin ChenNon-Stationary RLSequential Decision Making

  6. Spectral-Morphological Attention U-Net: An Efficient Network for Active Wildfire Detection

    Jul 17, 2026Yugong Zeng, Jonathan WuRemote Sensing Image SegmentationWildfire Detection

  7. Long-Context Fine-Tuning with Limited VRAM

    Jul 16, 2026Vladimir Fedosov, Aleksandr Sazhin, Artemiy Grinenko +1Fine-TuningKV-Cache Offloading

  8. Screening Is Effective for Visual Recognition

    Jul 15, 2026Shunya Shimomura, Kazuhiro HottaVision TransformerAttention Mechanisms

  9. DAGR: State-Conditioned Goal Representations via Difference-Aware Goal Cross-Attention

    Jul 15, 2026Xing Lei, Wenyan Yang, Xuetao Zhang +1Reinforcement LearningAttention Mechanisms

  10. Causal Supervision of Attention for Affective Behaviour Analysis

    Jul 13, 2026Nemanja Rašajski, Konstantinos Makantasis, Antonios Liapis +1Causal Representation LearningFacial Action Unit Detection

  11. Controlling Motion Transfer in Diffusion Transformers via Attention Heads

    Jul 13, 2026Sunyoung Jung, Jiwoo Park, Yoonseok Choi +3Diffusion Model GuidanceDiffusion Transformer

  12. Learning To Focus: Anatomy-Guided Attention Regularization for Medical Image Classification

    Jul 12, 2026Tonmoy Hossain, Atiqur Rahman, Farhana Hossain Swarnali +1Medical Image ClassificationAttention Mechanisms

  13. Geometry-aware Gaussian Prior and Axial Attention for Cervical Cytology Image Classification

    Jul 11, 2026Yating Li, Cheng Ye, Nenan Lyu +2Computational PathologyMedical Image Classification

  14. On Locality and Length Generalization in Visual Reasoning

    Jul 10, 2026Pulkit Madan, Sanjay Haresh, Reza Ebrahimi +3Visual ReasoningLength Generalization

  15. LEEVLA: Seeing What Matters in Latent Environment Evolution for Vision-Language-Action

    Jul 9, 2026Qi Lyu, Baicheng Liu, Xudong Wang +3Latent Dynamics ModelingVision-Language-Action Models

  16. LBR: Towards Mitigating Length Bias in Large Language Models for Recommendation

    Jul 5, 2026Hongchen Li, Bohao Wang, Jingbang Chen +5Large Language Model-Based RecommendationAttention Mechanisms

  17. Beyond Scene Priors: Fine-Grained Traffic Scene Reasoning with Benchmarking and Query-Guided Small-Object Focus

    Jul 5, 2026Waikit Xiu, Qiang Lu, Zian Wang +4Visual Question AnsweringVLMs for Autonomous Driving

  18. MACRO: Training-free Multi-plane Attention for Closeup Render Optimization

    Jul 4, 2026Nitzan Hodos, Roy Amoyal, Lior Fritz +33D Gaussian SplattingImage Enhancement

  19. Sequential Correlations Change In-Context Learning: Effective Context Length and Architectural Mismatch

    Jul 4, 2026Mary Letey, Yue M. Lu, Cengiz Pehlevan +1In-Context LearningAttention Mechanisms

  20. Learning to Generate Multiple Objects from Dense and Occluded Layouts

    Jul 3, 2026Bach-Hoang Ngo, Si-Tri Ngo, Hieu Le +1Image GenerationCompositional Image Generation

  21. LBTCap: A Lightweight Bilateral Transformer for Real-Time Remote Sensing Image Change Captioning

    Jul 3, 2026Licheng Zhang, Siew-Kei Lam, Naveed AkhtarRemote Sensing Image UnderstandingImage Captioning

  22. Self-Gating Attention for Efficient Time Series Forecasting

    Jul 2, 2026Dezheng Wang, Tong Chen, Wei Yuan +3Time Series ForecastingLinear Attention

  23. DeepGaze3.5-VL: Modeling Scanpaths via Autoregressive Token Prediction

    Jul 2, 2026Susmit Agrawal, Matthias Bethge, Matthias KümmererVisual AttentionAttention Mechanisms

  24. HistoSeg++: Delving deeper with attention and multiscale feature fusion for biomarker segmentation

    Jul 2, 2026Saad Wazir, Rao Faizan, Daeyoung KimU-NetMulti-Scale Feature Fusion