Attention Mechanisms

Momentum

42 papers in the last four weeks, up 100% on the four weeks before. 0.4% of all new papers.

Jul 13Week of Sep 28

Latest papers 378

All topics
CardsList
  1. Towards Memory-Efficient Autoregressive Video Generation via Instance-Specific Parametric Absorption

    Jul 1, 2026Xiaomeng Fu, Jia Li, Yiming Hu +5Long-Horizon Video GenerationStreaming Video Generation

  2. RotateAttention: RoPE-Aware Rotation and Range Rectification for INT4 Quantized Attention in Video Generation

    Jul 1, 2026Yaofu Liu, Wanli Lan, Jinxi Li +2Mixed-Precision QuantizationRotary Positional Embeddings

  3. Enhancing Oracle Bone Inscription Recognition via Multi-Scale Layer Attention

    Jun 30, 2026Chaowen Yan, Kaishen Wang, Yong Wang +2Multi-Scale Feature FusionAttention Mechanisms

  4. MAGE: View-guided Point Cloud Completion with Efficient Modality Alignment and Adaptive Geometry Enhancement

    Jun 30, 2026Weize Quan, Zhengwei Wu, Kai Wang +1Point Cloud CompletionCross-Modal Alignment

  5. Reweighting Framewise Attention in Video Transformers for Facial Expression Understanding

    Jun 29, 2026Seongro Yoon, Donghyeon Cho, Jinsun Park +1Vision TransformerFacial Expression Recognition

  6. Learning High-Level Decision Making with an Interaction-Aware Attention-Based Network in Autonomous Driving

    Jun 29, 2026Marcelo Contreras, Willi Poh, Christoph Stiller +1Autonomous DrivingAttention Mechanisms

  7. Adaptive Financial Transformer with Regime-Gated Attention for Stock Return Prediction

    Jun 28, 2026Dishan SarkarMultivariate Time Series ForecastingTime Series Forecasting

  8. DnA: Denoising Attention for Visual Tasks

    Jun 25, 2026Ron Campos, Subhajit Maity, Xin Li +2Visual AttentionVision Transformer

  9. Enhancing Layer Interaction Using Key-Correlated Layer Attention

    Jun 24, 2026Jianlong Xiong, ChuanBo Xie, Le Yu +2Efficient AttentionLinear Attention

  10. Lightweight PCGAE-Net: Parallel CrossGate Attention and Bottleneck AutoEncoder for Efficient 5G Channel Prediction

    Jun 24, 2026Uma Kishore Godavarti, K. Giridhar, Vanani Prince Dharmendrabhai +2AutoencodersAttention Mechanisms

  11. All Routes Lead to Collapse

    Jun 21, 2026K. R. BalasubramanianRepresentation CollapseAttention Sinks

  12. CoSA: Correlation-Guided Change Attention with Learnable Residual Gating for Remote Sensing Change Detection

    Jun 20, 2026Abdirashid Omar, Jonghyuk ParkRemote Sensing Change DetectionAttention Mechanisms

  13. Attention as Frustrated Synchronization

    Jun 17, 2026Joshua NunleyOscillatory Neural NetworksAutoregressive Language Modeling

  14. Hierarchical Attention via Domain Decomposition

    Jun 16, 2026Stephan Köhler, Oliver RheinbachLow-Rank AttentionPDE Operator Learning

  15. Attention Alignment Between Humans and Vision-Language Models

    Jun 16, 2026Isaac R. Christian, Udith Haputhanthrige, Hanna Hornfeld +4VLM EvaluationVisual Attention

  16. Taylor-Calibrate: Principled Initialization for Hybrid Linear Attention Distillation

    Jun 15, 2026Zhongzhu Zhou, Qingyang Wu, Junxiong Wang +4Neural Network InitializationLinear Attention

  17. QK-Normed MLA: QK normalization without full key caching

    Jun 15, 2026Yizhou Han, Yao Zhao, Jun Zhou +2KV CachingTransformer Attention

  18. Rethinking the Role of Efficient Attention in Hybrid Architectures

    Jun 13, 2026Ziqing Qiao, Yinuo Xu, Chaojun Xiao +6Attention Head AnalysisLong-Context Modeling

  19. Zero-shot generalization of transformer neural operators to larger domains

    Jun 12, 2026Armand de Villeroché, Sibo Cheng, Vincent Le Guen +5Local AttentionPDE Operator Learning

  20. WAM4D: Fast 4D World Action Model via Spatial Register Tokens

    Jun 12, 2026Ying Li, Xiaobao Wei, Jiajun Cao +10World Models for RoboticsRobotic Manipulation