Visual Attention

Momentum

2 papers in the last four weeks, down 33% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 38

All topics
CardsList
  1. Grounded Joint-Attention Other-Play for Zero-Shot Coordination

    Oct 5, 2026Giulia Benintendi, Constantin Ruhdorfer, Fabian Kögel +1Multi-Agent CoordinationVisual Attention

  2. Eyes on the Road: A Naturalistic Comparison of MTW Rider Gaze in Urban Indian Traffic

    Sep 27, 2026Prerak Srivastava, Bhaiya Vaibhaw Kumar, Kavita VemuriVisual AttentionEye Tracking

  3. Event-based Selective Attention for Multi-resolution Fast Region of Interest (ROI) Detection

    Sep 15, 2026Luca Peres, Giulia D'Angelo, Chiara Bartolozzi +1Event-Based VisionVisual Attention

  4. Visual Attention Faithfulness in Vision-Language Models is Heterogeneous

    Sep 1, 2026Xurui Song, Weishi Wang, Zhongqi Yue +5VLM EvaluationVisual Question Answering

  5. Attention from Action, for Action: Emergent Visual Bottlenecks for Policy Learning

    Aug 13, 2026Zheyu Zhuang, Ruiyu Wang, Nick Heppert +4Visual AttentionVisuomotor Policy Learning

  6. Human versus Computer Vision

    Aug 10, 2026Elena SirotkinaVisual AttentionAlgorithmic Fairness

  7. Learning to Predict Middle-Layer Attention in MLLMs for Visual Token Pruning

    Aug 4, 2026Yuyao Sun, Tao Deng, Shuang Li +3Visual AttentionEfficient VLM Inference

  8. GuidedAttention: Interpretable and Correctable Visual Attention for OOD-Robust Robot Manipulation via Imitation Learning

    Jul 23, 2026Masaki Murooka, Ryoichi Nakajo, Keisuke Shirai +4Visual AttentionRobot Skill Learning

  9. Attention-Guided Saliency Maps for Interpreting Visualization Literacy in VLMs

    Jul 17, 2026Maeve Hutchinson, Abderrahmane Wassim Mehdaoui, Pranava MadhyasthaData VisualizationVisual Attention

  10. TDSal: Task-Based Top-Down Saliency Prediction Model

    Jul 10, 2026Can Mizrakli, Tolga K. CapinVisual AttentionSalient Object Detection

  11. Sparse Attention for Dense Open-Vocabulary Prediction in CLIP

    Jul 8, 2026Fatimah Zohra, Chen Zhao, Shuming Liu +1Visual AttentionFine-Grained Image Retrieval

  12. An Event-Driven Framework for Fly-Inspired Visual Motion Detection

    Jul 6, 2026Qinbing Fu, Jingyu Huang, Yan Xie +2Event-Based VisionVisual Attention

  13. Modeling the Impact of Visual Brand Language on Attention, Object Recognition, and Memory Retrieval

    Jul 3, 2026Rachel F. Heaton, John E. HummelVisual Attention

  14. DeepGaze3.5-VL: Modeling Scanpaths via Autoregressive Token Prediction

    Jul 2, 2026Susmit Agrawal, Matthias Bethge, Matthias KümmererVisual AttentionAttention Mechanisms

  15. CPR: Chained Perceptual Refinement for Coarse-to-Fine Medical Image Classification

    Jul 1, 2026Si-Yuan Lu, Hanruo Zhu, Ziquan Zhu +6Visual AttentionMedical Image Analysis

  16. See Only When Needed: Context-Aware Attention Intervention for Mitigating Hallucinations in LVLMs

    Jun 29, 2026Yuqing Lei, Wenbo Lyu, Yingjun Du +3Visual AttentionLarge Vision-Language Models

  17. DnA: Denoising Attention for Visual Tasks

    Jun 25, 2026Ron Campos, Subhajit Maity, Xin Li +2Visual AttentionVision Transformer

  18. Listening makes Vision Clear for VLMs

    Jun 22, 2026Yiyang Chen, Yixin Tan, Binrui ShenVLM EvaluationVisual Attention

  19. Attention Alignment Between Humans and Vision-Language Models

    Jun 16, 2026Isaac R. Christian, Udith Haputhanthrige, Hanna Hornfeld +4VLM EvaluationVisual Attention

  20. Gaze Heads: How VLMs Look at What They Describe

    Jun 12, 2026Rohit Gandikota, David BauImage CaptioningVisual Attention

  21. RATS! Patches Talk Through Registers: Emergent Parts in Register Attention Transformers

    Jun 12, 2026Timing Yang, Predrag Neskovic, Jansen Seheult +4Visual AttentionVisual Representation Learning

  22. Magnifying What Matters: Attention-Guided Adaptive Rendering for Visual Text Comprehension

    Jun 11, 2026Shenglai Zeng, Qirui Wang, Kai Guo +3VLM RobustnessVisual Attention

  23. Attend to Anything: Foundation Model for Unified Human Attention Modeling

    Jun 2, 2026Wenzhuo Zhao, Ronghao Xian, Keren Fu +1Visual AttentionUnified Multimodal Models

  24. A2A^2: Smaller Self-Supervised ViTs Localize Better than Larger Ones

    Jun 2, 2026Sreehari Rammohan, Huy Ha, Carl VondrickVisual AttentionVision Transformer

  25. VisionPulse: Dynamic Visual Sparsity for Efficient Multimodal Reasoning

    May 29, 2026Hengbo Xu, Shengjie Jin, Yanbiao Ma +1Efficient Multimodal InferenceVisual Attention

  26. Improved Belief-Attention in Vision Task

    May 22, 2026Guoqiang ZhangVisual AttentionSelf-Attention

  27. RAVE: Re-Allocating Visual Attention in Large Multimodal Models

    May 18, 2026Xi Leng, Xinhong Ma, Ziqiang Dong +4Visual AttentionSelf-Attention

  28. Why We Look Where We Look: Emergent Human-like Fixations of a Foveated Visual Language Model Maximizing Scene Understanding

    May 18, 2026Shravan Murlidaran, Ziqi Wen, Sana Shehabi +1Visual AttentionLarge Vision-Language Models

  29. FastOCR: Dynamic Visual Fixation via KV Cache Pruning for Efficient Document Parsing

    May 17, 2026Zihan Tang, Leqi Shen, Hui Chen +7Visual AttentionEfficient VLM Inference

  30. Towards Gaze-Informed AI Disclosure Interfaces: Eye-Tracking Attentional and Cognitive Load While Reading AI-Assisted News

    May 14, 2026Pooja Prajod, Hannes Cools, Thomas Röggla +2Visual AttentionHuman-Centered AI

  31. What-Where Transformer: A Slot-Centric Visual Backbone for Concurrent Representation and Localization

    May 12, 2026Ryota Yoshihashi, Masahiro Kada, Satoshi Ikehata +2Visual AttentionVision Transformer

  32. Neuromorphic visual attention for Sign-language recognition on SpiNNaker

    May 7, 2026Sarka Liskova, Olha Vedmedenko, Mazdak Fatahi +3Event-Based VisionVisual Attention

  33. Foveated Reasoning: Stateful, Action-based Visual Focusing for Vision-Language Models

    Apr 22, 2026Juhong Min, Lazar Valkov, Vitali Petsiuk +2Visual AttentionEfficient VLM Inference

  34. Dispatch-Aware Ragged Attention for Pruned Vision Transformers

    Apr 16, 2026Seifeldin Abdellatif, Ahmad AlmasriEfficient Transformer InferenceVisual Attention

  35. Debiasing Central Fixation Confounds Reveals a Peripheral "Sweet Spot" for Human-like Scanpaths in Hard-Attention Vision

    Feb 16, 2026Pengcheng Pan, Yonekura Shogo, Yasuo KuniyoshVisual AttentionEye Tracking