Visual Token Pruning

Momentum

24 papers in the last four weeks, up 118% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 130

All topics
CardsList
  1. DIPrune: Task-Aware Token Pruning with Dual Importance for Efficient Multimodal Language Models

    Oct 6, 2026Shuo Yang, Changbai Li, Linlin Yang +6Visual Token PruningMultimodal Large Language Models

  2. MWOP: Modality-aware Width-wise Operation Pruning for Efficient MLLMs

    Oct 1, 2026Xudong Wang, Hao Wu, Haozhe Hu +5Visual Token PruningLarge Language Model Compression

  3. When Masking Helps or Hurts Robustness in Compressed CLIP: A Pre-Deployment Diagnostic

    Sep 30, 2026Muhammad Zawish, Steven DavyVisual Token PruningMask2Former

  4. Audio Token Attention Is Predictable Before the Language Model Runs

    Sep 30, 2026Kyoungjun Park, Yunzhe Li, Lili QiuLarge Audio Language ModelsAudio Understanding

  5. TReVS: Integrating Textual Relevance and Visual Saliency for Efficient Vision-Language Model Token Pruning

    Sep 29, 2026Jing Wang, Zhiping Wu, Dongdong Ren +3Visual Token PruningRecent Vision-Language Models

  6. Hierarchical Compression of Vision-Language Model Benchmarks

    Sep 29, 2026Hyunjong Ok, Seunggu Kang, Jaeho LeeVisual Token PruningMultimodal Evaluation

  7. Beyond Token Importance: Preserving Spatial Scaffolds for Efficient Vision-Language-Action Inference

    Sep 29, 2026Jiayu Chen, Shuyong Gao, Jingkai Jia +6Visual Token PruningDiffusion-Based Vision-Language-Actions

  8. SPIDER: Multi-Layer Semantic Token Pruning and Adaptive Sub-Layer Skipping in Multimodal Large Language Models

    Sep 28, 2026Tianxiang Chen, Zhentao Tan, Zi Ye +9Visual Token PruningMultimodal Large Language Models

  9. P4Q: Co-designing Token Pruning and Quantization for Vision-Language Model Acceleration

    Sep 28, 2026Haizhao Jing, Zhenhao Shang, Haokui Zhang +2Visual Token PruningLarge Language Model Quantization

  10. When Text Matters: Design Principles for Visual Token Pruning in Vision-Language Model

    Sep 28, 2026Minchan Kang, Kyeonghye Park, Seoyoung Cho +2Visual Token PruningRecent Vision-Language Models

  11. ACPruner: Visual Token Pruning as Biased Attention Coverage Maximization in LVLMs

    Sep 28, 2026Xu Li, Yuxuan Liang, Yi Zheng +6Visual Token PruningSaliency

  12. DORA: Dynamic Online Reinforcement Agent for Token Pruning in Vision Transformers

    Sep 28, 2026Kaixuan He, Song Chen, Yi KangVisual Token PruningVision Transformer

  13. SCOPD: Sparse-Context On-Policy Self-Distillation for Efficient Vision-Language Models

    Sep 28, 2026Ahmadreza Jeddi, Enming Zhang, Jasper Gerigk +12Visual Token PruningRecent Vision-Language Models

  14. EAT: Expert Account Tracker for Efficient MoE Inference

    Sep 27, 2026Yuexian Li, Yifei Yang, Zouying Cao +1Mixture-Of-ExpertsExperts

  15. SLICEChat: Progressive In-Encoder Token Pruning for Whole-Slide Pathology Language Models

    Sep 21, 2026Ali Kerem Bozkurt, Baris Cem Bakay, Ibrahim Kulac +3Whole-Slide ImagesPathology Foundation Models

  16. VPRune: Efficient Training-free Pre-LLM Visual Token Pruning

    Sep 21, 2026Guangchuan Lv, Dianxing Shi, Dingjie FuVisual Token PruningRecent Vision-Language Models

  17. Layer-Aware Position Embeddings for Visual Token Pruning in Multimodal Large Language Models

    Sep 20, 2026Yahong Wang, Zhangkai Ni, Juncheng Wu +3Visual Token PruningMultimodal Large Language Models

  18. QCPruner: Query-Conditioned Population Coverage for Visual Token Pruning

    Sep 17, 2026Shengli He, Yongchao Liang, Roumeng He +4Visual Token PruningMultimodal Large Language Models

  19. AsyncCouple-Flow: Asynchronous Cross-Modal Coupling and Flow Matching for Spatio-Temporal Forecasting

    Sep 15, 2026Zhixiang Wu, Yining Liu, Bo Zhao +4Spatio-Temporal ForecastingMulti-Stream Temporal Fusion

  20. Don't Send What You Don't Need: Question-Guided Token Pruning as a Privacy Defense for Vision-Language Models

    Sep 14, 2026Md Khalid Syfullah, Alvi Ataur KhalilVisual Token PruningPrivacy

  21. Beyond One-Size-Fits-All: Sample-Adaptive Strategy Routing for Vision Token Pruning in MLLMs

    Sep 9, 2026Haiji Liang, Pengfei Zhou, Zhenglin Wan +3Visual Token PruningMultimodal Large Language Models

  22. TRACE: Trajectory-robust Admission with Evidence Ordering for Efficient GUI Agents

    Sep 9, 2026Yuhao Wang, Mu Qiao, Xindong Zhang +3Visual Token PruningTraces

  23. Which Tokens Should SFT Actually Learn? A Token-Trimming Perspective on Mathematical Reasoning

    Sep 9, 2026Yaning Jia, Chunhui Zhang, Wenxuan Xu +3Supervised FinetuningMathematical Reasoning Benchmarks

  24. CoVeR: Coverage-Based Token Pruning for Multi-View 3D Reasoning in VLMs

    Sep 8, 2026Nhat-Tan Bui, Varshini Elangovan, Arun Reddy Anugu +7Visual Token PruningVoxel

  25. TAP-Path: Task-Adaptive Structural and Token Pruning for Efficient and Trustworthy Pathology Foundation Models

    Sep 3, 2026Mehedi Hasan, Ashfak Yeafi, Md Khairul IslamPathology Foundation ModelsWireless Foundation Models

  26. Who Speaks for the Pruned? Visual Token Pruning as Coverage Optimization

    Sep 2, 2026Qingchan Zhu, Weihang You, Hanqi Jiang +3Visual Token PruningPrompt Optimization

  27. S2^2Prune: Spatially Structured Visual Token Pruning for Multimodal Large Language Models

    Sep 1, 2026Yuanyuan Jia, Shunpu Tang, Qianqian YangVisual Token PruningMultimodal Large Language Models

  28. SinkPruner: Sink-Free Visual Token Pruning for Multimodal Large Language Models

    Sep 1, 2026Shiyu Li, Zi-Yuan Hu, Shijia Huang +3Visual Token PruningLong Visual-Token Sequences

  29. From Saliency to Discriminability: Rank-Preserving Visual Token Pruning for VLM Rerankers

    Sep 1, 2026Siyi Liu, Hanjun Yang, Chenchen Zhang +7Visual Token PruningLarge Language Model Reranking

  30. PACE: A Unified Condense-and-Extract Paradigm for Fast VLM Inference

    Aug 27, 2026Junjie Liu, Shengyuan Ye, Xu ChenVisual Token Pruning

  31. Multi-Image Visual Token Pruning in Large Visual Language Models

    Aug 27, 2026Rongyang Zhang, Chengqiang Lu, Cong Li +9Visual Token Pruning

  32. CoverPrune: Coverage-Driven Token Pruning for 3D VLMs via Optimal Transport

    Aug 13, 2026Peng Ling, Yingda Yin, Lingting Zhu +5Visual Token Pruning3D Spatial Reasoning

  33. Putting Registers to Work: Task Registers for Token Pruning in Vision Transformers

    Aug 11, 2026Hongsen Cao, Mona Jaber, Shanxin Yuan +1Visual Token PruningSelf-Supervised Vision Transformers

  34. When Vision Becomes Text: Visual Token Pruning via Cross-Modal Residual Guidance in VLMs

    Aug 11, 2026Congyang Ou, Ruike Song, Yang Zhou +3Visual Token PruningCross-Modal

  35. An AI4AI Framework for Visual Token Pruning

    Aug 7, 2026Zhen Liu, Wenli Huang, Wei Song +3Visual Token PruningMultimodal Benchmarks

  36. RoRA: Role-Oriented Regional Allocation for Visual Token Pruning in MLLMs

    Aug 7, 2026Qiyanhui Lu, Han Wu, Rongjian Xu +6Visual Token PruningMultimodal Large Language Models

  37. Prune Once: Retraining-Free Task-Agnostic Pruning for Vision-Language Models

    Aug 7, 2026Minseok Kang, Hyunwoo Kim, Chanyoung Kim +3Visual Token PruningLarge Language Model Compression

  38. MOAT: Model-Agnostic Randomized Transformations for preventing Efficiency Degradation Attacks on ViTs

    Aug 5, 2026Anadi Goyal, Nandish Chattopadhyay, Chandan Karfa +2Model-Agnostic DefenseSelf-Supervised Vision Transformers

  39. A Survey of Adversarial Efficiency Degradation for Vision Transformer by Exploiting Input-adaptive Optimization

    Aug 5, 2026Anadi Goyal, Nandish Chattopadhyay, Anupam Chattopadhyay +1Vision TransformerVisual Token Pruning

  40. DIVE: Dynamic Iterative Visual Evidence Construction for Efficient Vision-Language Models

    Aug 5, 2026Chen Zhong, Xiao An, Zijie Wang +3Long Visual-Token SequencesRecent Vision-Language Models

  41. Not All Redundant Tokens Are Alike: Analyzing Visual Token Pruning through Token Roles

    Aug 5, 2026Hyeonyu Kim, Sehwan Lim, Youngwon Choi +2Visual Token PruningLens

  42. Keep the Needle, Prune the Haystack: Defect-Preserving Token Pruning for Efficient Zero-Shot Anomaly Detection

    Aug 4, 2026Yanning Hou, Jingyuan Zhang, Xiaoyun Wang +3Multimodal Anomaly DetectionVisual Token Pruning

  43. Efficient Multilingual Neural Machine Translation via Corpus-Driven Vocabulary Pruning: An English-Arabic Case Study

    Aug 4, 2026Ahmed Amine Aliane, Nasredine Semmar, Hassina AlianeNeural Machine TranslationVisual Token Pruning

  44. Learning to Predict Middle-Layer Attention in MLLMs for Visual Token Pruning

    Aug 4, 2026Yuyao Sun, Tao Deng, Shuang Li +3Visual Token PruningRecent Vision-Language Models

  45. GSTEP: Global Spatio-Temporal Density-Driven Visual Token Pruning for Efficient Video Large Language Models

    Aug 4, 2026Mengjie Zhang, Qihui Zhu, Tao Zhang +10Visual Token PruningVideo-Language Models

  46. DiffPrune: differentiable information throttling for token pruning in vision-language models

    Aug 3, 2026Landi He, Mingde Yao, Shawn Young +1Visual Token PruningDifferentiable Physics

  47. ET-Prune: Evidence-Aware Dynamic Budgeting for Visual Token Pruning in Text-Rich MLLMs

    Aug 3, 2026Zizhong Ding, Junxian Li, Kai Liu +4Visual Token PruningMultimodal Large Language Models

  48. Pruned BPE: Post-training Visibility Pruning and Token Reallocation for Byte Pair Encoding

    Aug 1, 2026Kenny ShaoByte-Pair EncodingSubword Tokenization

  49. Interpretability-Guided Soft Pruning of Attention Heads in Vision Transformers

    Jul 31, 2026Kamil Książek, Piotr Suszyński, Michał Jan Włodarczyk +2Self-Supervised Vision TransformersVision Transformer

  50. WIDE: Boosting Adaptive LLM Inference via Token-level Dynamic Width Pruning

    Jul 30, 2026Haozhe Hu, Hao Wu, Peiran Yin +3Visual Token PruningLLM Inference Optimization

  51. Capturing Token Tendencies for Training-Free Token Pruning in Multimodal Large Language Models

    Jul 30, 2026Jie Ma, Zhike Qiu, Jie Gao +4Visual Token PruningMultimodal Large Language Models

  52. LAST: The Last Query Token Guides Visual Token Pruning for Edge-Cloud Collaborative MLLM Inference

    Jul 30, 2026Feng Yang, Xinrui Ju, Keyang Zhang +6Visual Token PruningLLM Inference Optimization

  53. Beyond Accuracy: Auditing Spatial Provenance in Visual Token Pruning for OCR-Critical MLLM Inference

    Jul 29, 2026Feixiang Liu, Qiang Qiu, Hao Zhang +1Visual Token PruningMultimodal Large Language Models

  54. SepPrune:A Separator-based Pruning Framework for Efficient Multimodal Large Language Models

    Jul 28, 2026Yuchen Wang, Qihui Zhu, Yang Liu +2Visual Token PruningLong Visual-Token Sequences

  55. PathSelect: Sequential Token Selection for Whole Slide Pathology

    Jul 26, 2026Jingzhi Chen, Landi He, Zehong Chen +2Visual Token PruningDownstream Fine-Tuning