Attention Mechanisms

Momentum

42 papers in the last four weeks, up 100% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 378

All topics
CardsList
  1. Don't Read Everything: A Curvature-Conditioned Query for Linear Attention

    May 31, 2026Dong Le, Thong Nguyen, Cong-Duy Nguyen +1In-Context RetrievalLong-Context Language Modeling

  2. Efficient Temporal Modeling for Mobile Sleep Staging via Lightweight Random Attention

    May 31, 2026Guisong Liu, Pengfei Wei, Jainsong Zhang +1Sleep Stage ClassificationAttention Mechanisms

  3. Global-Local Attention Decomposition for Terrain Encoding in Humanoid Perceptive Locomotion

    May 30, 2026Shengcheng Fu, Yang Zhang, Zhanxiang Cao +4Legged RoboticsHumanoid Robot Locomotion

  4. Functional Attention: From Pairwise Affinities to Functional Correspondences

    May 29, 2026Jiefang Xiao, Maolin Gao, Simon Weber +2PDE Operator LearningAttention Mechanisms

  5. MultiAct: Text-to-Motion Generation from Composite Text via Tailored Attention Guidance

    May 29, 2026Nathan Sala, Ofir Abramovich, Ariel Shamir +3Text-to-Motion GenerationCross-Modal Attention

  6. Attend to Evidence: Evidence-Anchored Spatial Attention Supervision for Multimodal RLVR

    May 29, 2026Ruina Hu, Chen Wang, Lai Wei +5Reinforcement Learning with Verifiable RewardsVisually Grounded Reasoning

  7. A Novel Global Context-aware Deep Neural Network for Enhanced Brain Tumor Segmentation using Magnetic Resonance Images

    May 28, 2026Sourjya Mukherjee, Ananya Bhattacharjee, R. MuruganU-NetMedical Image Segmentation

  8. VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion

    May 28, 2026Hidir Yesiltepe, Jiazhen Hu, Tuna Han Salih Meral +4Video Diffusion ModelsSelf-Attention

  9. Improving Adversarial Robustness of Attribution via Implicit Regularization

    May 28, 2026Amir Mehrpanah, Matteo Gamba, Hossein AzizpourTransformer InterpretabilityNeural Network Robustness

  10. Gated Graph Attention Networks with Learnable Temperature

    May 28, 2026Zhongtian Ma, Hao Wu, Yexin Zhang +2Graph Attention NetworksGraph Neural Networks

  11. High-Fidelity Industrial Crash Dynamics Prediction via Geometry-Aware Operator Learning with Memory-Efficient Low-Rank Attention

    May 26, 2026Deepak Akhare, Mohammad Amin Nabian, Corey Adams +2Low-Rank AttentionSurrogate Modeling

  12. LaneRoPE: Positional Encoding for Collaborative Parallel Reasoning and Generation

    May 26, 2026Gabriele Cesa, Thomas Hehn, Aleix Torres-Camps +4Rotary Positional EmbeddingsParallel Decoding

  13. Neuronal Stochastic Attention Circuit (NSAC) for Probabilistic Representation Learning

    May 25, 2026Waleed Razzaq, Yun-Bo ZhaoRepresentation LearningUncertainty Quantification

  14. Triplet-Block Diffusion RWKV

    May 25, 2026Ke Lin, Yiyang Luo, Zhaolong Su +2Diffusion Language Model InferenceRecurrent Transformers

  15. ADMFormer: An Adaptive-Decomposition Transformer with Time-Varying Masked Spatial Attention for Traffic Forecasting

    May 25, 2026Ruiwen Gu, Qitai Tan, Yahao Liu +1Attention MechanismsSpatiotemporal Forecasting

  16. Quaternion Self-Attention with Shared Scores

    May 24, 2026Shogo Yamauchi, Tohru Nitta, Hideaki TamoriSelf-AttentionAttention Mechanisms

  17. Patch Hierarchical Attention Transformer for Efficient Particle Jet Tagging

    May 20, 2026Aaron Wang, Zihan Zhao, Alan Xia +5Jet TaggingEfficient Attention

  18. DASH: Fast Differentiable Architecture Search for Hybrid Attention in Minutes on a Single GPU

    May 20, 2026Weizhe Chen, Miao Zhang, Junpeng Jiang +3LLM Inference EfficiencyAttention Mechanisms

  19. RoPeSLR: 3D RoPE-driven Sparse-LowRank Attention for Efficient Diffusion Transformers

    May 20, 2026Yuxi Liu, Zekun Zhang, Yixiang Cai +3Rotary Positional EmbeddingsLow-Rank Attention

  20. DashAttention: Differentiable and Adaptive Sparse Hierarchical Attention

    May 18, 2026Yuxiang Huang, Nuno M. T. Gonçalves, Federico Alvetreti +5Self-AttentionLong-Context Modeling

  21. RAVE: Re-Allocating Visual Attention in Large Multimodal Models

    May 18, 2026Xi Leng, Xinhong Ma, Ziqiang Dong +4Visual AttentionSelf-Attention

  22. Optimising CSRNet with parameter-free attention mechanisms for crowd counting in public transport

    May 18, 2026Aida Rostamza, Enrico Del Re, Joshua Cherian Varughese +1Intelligent Transportation SystemsCrowd Counting

  23. Babel: Jailbreaking Safety Attention via Obfuscation Distribution Optimized Sampling

    May 18, 2026Ziwei Wang, Jing Chen, Ruichao Liang +6LLM SafetyLLM Jailbreak Attacks

  24. CounterCount: A Diagnostic Framework for Counting Bias in Vision Language Models

    May 18, 2026Reem Alzahrani, Hassan Alshanqiti, Bushra Bin Hemid +3VLM EvaluationVision-Language Models

  25. LLMForge: Multi-Backend Hardware-Aware Neural Architecture Search with Infinite-Head Attention for Edge Language Models

    May 17, 2026Xinting Jiang, Junyi Luo, Ruichen Qi +4On-Device Language Model InferenceHardware-Aware NAS

  26. Hamiltonian-Inspired Attention Mechanism for Scalable RF Transmitter Fingerprinting

    May 17, 2026Chitraksh Singh, Monisha Dhanraj, Akram SheriffTransformer AttentionPhysics-Informed ML