Vision State Space Models

Momentum

5 papers in the last four weeks, against 1 the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 30

All topics
CardsList
  1. When Should the Count Change? Learning State Maintenance for Causal Video Counting

    Sep 28, 2026Pengyiang Liu, Dongyue Lyu, Junbo Niu +3Fine-Grained Video UnderstandingVision State Space Models

  2. Just MLPs: Efficient Visual State Reconstruction for Multimodal Language Models

    Sep 28, 2026Jingdi lei, Junxian Li, Di Zhang +3Long Visual-Token SequencesMultimodal Large Language Models

  3. Token Clustering and Semantic Sequence Mamba for Hyperspectral Image Classification

    Sep 23, 2026Yimin Zhu, Mahmood Elahi, Lincoln Linlin XuHyperspectral ImageMamba-Based Models

  4. SBMVTrack: Spike-Budgeted Multi-View Learning for Power-Efficient UAV Tracking

    Sep 21, 2026Pengzhi Zhong, Jiwei Mo, Haolun Li +4Unmanned Aerial Vehicle DetectionMulti-Object Tracking

  5. Channel-Wise and Token-Aware Post-Training Quantization for Visual State Space Duality

    Sep 15, 2026Jonghyeon Lim, Changhoon YimPost-Training QuantizationVision State Space Models

  6. OphBiWSSD: Scaling Temporal Action Localization in Ophthalmic Surgeries with Bidirectional Weight-tied State Space Duality

    Sep 14, 2026Yang Liu, Qionghong Ma, Joongwon Chae +10Temporal Action LocalizationVision State Space Models

  7. EgoAfford: Task-Oriented Affordance Grounding via Egocentric Referring Segmentation

    Aug 5, 2026Xinyuan Guan, Feifan Chen, Xinyu Zhan +3Egocentric VisionGoal-Conditioned Dynamic Manipulation

  8. Norm or Direction? Decoding Vision Mambas for High-Resolution Vision

    Jul 21, 2026Jin Yu, Juyoun ParkMamba-Based ModelsVision State Space Models

  9. A Hybrid Mamba for Audio-Visual Navigation

    Jul 14, 2026Yi Wang, Yinfeng YuAudio-Visual ReasoningObject Goal Navigation

  10. Vision Non-Causal Trapezoidal Mamba: Eliminating Directional Scanning in Vision SSMs with Second-Order Dynamics

    Jul 3, 2026Anvitha Ramachandran, Dhruv Parikh, Haoyang Fan +2Vision State Space ModelsSelf-Supervised Vision Transformers

  11. MambaLIE: Scene Light Intensity-Boosted Low-Light Image Enhancement with State Space Model

    Jul 3, 2026Wanshu Fan, Xiangyu Li, Cong Wang +4Low-Light Image EnhancementVision State Space Models

  12. Spatial-Aware Reduction Framework: Towards Efficient and Faithful Visual State Space Models

    Jun 18, 2026Jindi Lv, Aoyu Li, Yuhao Zhou +6Vision State Space ModelsSpatial Tokens

  13. MambaCount: Efficient Text-guided Open-vocabulary Object Counting with Spatial Sparse State Space Duality Block

    Jun 16, 2026Hao-Yuan Ma, Li Zhang, Minjie Qiang +1Vision State Space ModelsSpatial Tokens

  14. VICX: Generalizable Robot Manipulation via Video Generation and In-Context Operator Network

    Jun 10, 2026Song Chen, Linyan Xiang, Ying Zhou +1Robotic ManipulationRobot Systems

  15. Learning Visual Spatial Planning from Symbolic State via Modality-Gap-Aware Self-Distillation

    Jun 4, 2026Haocheng Luo, Jiahui Liu, Ruicheng Zhang +6Vision State Space ModelsPerception Gap

  16. SP-MoMamba: Superpixel-driven Mixture of State Space Experts for Efficient Image Super-Resolution

    May 25, 2026Wenbin Zou, Yawen Cui, Yi Wang +5Vision State Space ModelsTopomamba

  17. Deformba: Vision State Space Model with Adaptive State Fusion

    May 20, 2026Hongyu Ke, Jack Morris, Yongkang Liu +4Vision State Space ModelsSelf-Supervised Vision Transformers

  18. SurgicalMamba: Dual-Path SSD with State Regramming for Online Surgical Phase Recognition

    May 14, 2026Sukju Oh, Sukkyu SunSurgical VideosVision State Space Models

  19. TCP-SSM: Efficient Vision State Space Models with Token-Conditioned Poles

    May 12, 2026Sara Shoouri, Morteza Tavakoli Taba, Hun-Seok KimVision State Space ModelsState Space Models

  20. Can Graphs Help Vision SSMs See Better?

    May 11, 2026Dhruv Parikh, Anvitha Ramachandran, Haoyang Fan +3Vision State Space ModelsSemantic Segmentation

  21. Learning Dynamic Evidence Routes for Vision Transformer Probing

    Apr 29, 2026Zice Wang, Zhenyu ZhangLong Visual-Token SequencesVision State Space Models

  22. PKS4\text{PKS}^4:Parallel Kinematic Selective State Space Scanners for Efficient Video Understanding

    Apr 29, 2026Lingjie Zeng, Hailun Zhang, Xiwen Wang +1Spatio-Temporal AttentionVision State Space Models

  23. BVI-Mamba: Video Enhancement Using a Visual State-Space Model for Low-Light and Underwater Environments

    Apr 26, 2026Guoxi Huang, Ruirui Lin, Yini Li +2Underwater Image Enhancement MethodsVision State Space Models

  24. Exploring High-Order Self-Similarity for Video Understanding

    Apr 22, 2026Manjin Kim, Heeseung Kwon, Karteek Alahari +1Fine-Grained Video UnderstandingVideo Understanding

  25. Beyond ZOH: Advanced Discretization Strategies for Vision Mamba

    Apr 22, 2026Fady Ibrahim, Guangjun Liu, Guanghui WangVision State Space ModelsVision Foundation Models

  26. A Controlled Benchmark of Visual State-Space Backbones with Domain-Shift and Boundary Analysis for Remote-Sensing Segmentation

    Apr 20, 2026Nichula Wasalathilaka, Dineth Perera, Oshadha Samarakoon +4Vision State Space ModelsVision Transformer