Token Compression

Momentum

12 papers in the last four weeks, up 200% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 81

All topics
CardsList
  1. VETO: Video Efficient Token Optimization for Vision Language Models

    Oct 1, 2026Gueter Josmy Faure, Hao Ping Wang, Min-Hung Chen +1Token CompressionVideo-Language Models

  2. Q-SPT: Learnable Query-Based Compression for Low-Frame-Rate Speech Tokenization

    Oct 1, 2026Jeeyoung Yun, Seohwan Yun, Sungwoong KimNeural Speech CodecsAudio Tokenizers

  3. ITC-MoE: Importance-guided Token-aware Compression for MoE Diffusion Language Models

    Oct 1, 2026Lianjun Liu, Shipeng Li, You Huang +5Token CompressionLocalized Lora-Moe

  4. CoVisco: Codec-Native Vision Encoder with Native Token Compression for Unified Image-Video Understanding

    Sep 30, 2026Yulong Liu, Xiaotian Han, Junyuan Shang +6Vision EncodersToken Compression

  5. DC-SAE: Deep Compression Semantic Autoencoder for Faster Diffusion Convergence

    Sep 30, 2026Xu Huang, Ye Huang, Zijun Liao +6Generative Image CompressionToken Compression

  6. Feature-Aware Token Attack for Compression-Triggered Stealthy Failures in Large Vision-Language Models

    Sep 30, 2026Shilinlu Yan, Bowen Chen, Yuechen Zhang +3Token CompressionVision Encoders

  7. Aperture: Merge-Consistent Rotary States for Compressed Tokens

    Sep 29, 2026Yuhao Du, Shunian ChenToken CompressionRotary Position Embedding

  8. Rethinking Visual Token Compression for Video Large Language Models: A Simple Yet Strong Baseline

    Sep 28, 2026Xiao Zhang, Wang Zeng, Sheng Jin +3Token CompressionStrong Baseline

  9. Still There, No Longer Seen: Exposing Compression-Induced Risk in Large Vision-Language Models

    Sep 28, 2026Qiankun Li, Yuechen Zhang, Bowen Chen +4Token CompressionInference Cost

  10. CoViST: Visual Token Compression via Composable States

    Sep 27, 2026Qi Zhang, Xiandong Meng, Ronggang Wang +1Token CompressionData Compression Methods

  11. Compressing AI Traffic: Standardized Neural Network Coding of Visual-Token Representations in Split Vision-Language Inference

    Sep 1, 2026Reza Heidari, Hamed R. Tavakoli, Juho KannalaToken CompressionVision Encoders

  12. Token-Oriented Semantic Communication with Pretrained Vision Transformers

    Aug 26, 2026Jiwoong Im, Minwoo Kim, Jaeho Lee +2Token CompressionSelf-Supervised Vision Transformers

  13. Just Noticeable Difference Modeling for Token Compression in Vision-Language-Action Models

    Aug 21, 2026Zhuoyuan Li, Rui Zhao, Jin Wang +5Token CompressionGoal-Conditioned Dynamic Manipulation

  14. Not All Visual Tokens Are Equally Safe to Remove:Consequence-Sensitive Visual Token Compression

    Aug 10, 2026Jingbo Wen, Liang He, Mingyu Cao +4Long Visual-Token SequencesToken Compression

  15. Tevatron-Elastic: A Unified Abstraction for Training Elastic Retrievers and Rerankers

    Aug 9, 2026Yu Wang, Shengyao Zhuang, Xueguang Ma +4RetrieversTransformer Architectures

  16. HiSC: Hierarchical Spatial Clustering Token Compression for Efficient 3D Scene Understanding

    Aug 5, 2026Jiuhe Qu, Yingping Liang, Ying Fu3D Scene UnderstandingToken Compression

  17. OmniPack: Unified Token Compression for Efficient Omni-modal Large Language Models

    Aug 4, 2026Wanshun Su, Yang Shi, Feihu Liu +10Token CompressionOmni-Modal

  18. Decoupling semantics from vision: A framework for faithful visual-text compression evaluation

    Aug 3, 2026Yonghan Gao, Zehong Chen, Lijian Xu +3Token CompressionMultimodal Large Language Models

  19. Allocation Before Ranking: Decoupled Token Compression for OmniLLMs

    Aug 3, 2026Zhenghui Guo, Yilin Yang, Yuanbin Man +5Token CompressionData Compression Methods

  20. CRAFT: Compression via Recursive Adaptive Fusion of Video Tokens for Vision-Language Models

    Aug 3, 2026Yu Chen, Xiaohong Li, Xiaole Wang +3Token CompressionVideo-Language Models

  21. Rethinking Video Token Compression with a Global Codebook: Learning Once, Compressing Everywhere

    Aug 2, 2026Jiayang He, Tianling Xu, Diancheng Kang +4Token CompressionVideo Compression

  22. 3DZip: Spatial-Aware Feature Diversity-Guided Token Compression for 3D Question Answering

    Aug 2, 2026Changwoo Baek, Kyeongbo KongToken Compression3D Representation

  23. Think in Sets for Streaming Video Token Compression

    Aug 2, 2026Moxu Duan, Jingwen Fu, Yuwang WangToken CompressionTask-Aware Compression

  24. TopoCompress: Topology Aware Token Compression Algorithm for Distributed Edge MoE Inference

    Aug 1, 2026Ning Li, Xinyu Wang, Xin Yuan +3Mixture-Of-Expert InferenceToken Compression

  25. ORCA: ORgan-Centroid Aggregation for Training-Free 3D CT Visual Token Compression

    Jul 31, 2026Renjie Liang, Zijian Xu, Jinqian Pan +6Token CompressionCone-Beam Computed Tomography

  26. OmniDelta: Skill-Driven Budget Allocation for Token Compression in OmniLLMs

    Jul 28, 2026Haoyang Huang, Wenjie Huang, Tianqi Xu +14Token CompressionAudio Tokenizers

  27. Joint Optimization for Greedy Longest-match Tokenization

    Jul 25, 2026Adhiraj Singh, Deepanshu Mody, Ghina Al Shdaifat +4Byte-Pair EncodingToken Compression

  28. WaveZip: Wavelet-Driven Space-Time Decoupling for Video Token Condensation

    Jul 25, 2026Yuhui Zeng, Wang Chen, Jinfa Huang +5Token CompressionVideo Compression

  29. OmniScope: Modality-Decoupled Token Compression for Omnimodal Large Language Models

    Jul 25, 2026Jinsen Su, Yongdong Luo, Yuexiao Ma +3Token CompressionOmni-Modal

  30. Progressive Cramming: Reliable Token Compression and What It Reveals

    Jul 23, 2026Dmitrii Tarasov, Timofei Lashukov, Elizaveta Goncharova +1Token CompressionData Compression Methods

  31. Out of Sight, Still in Mind: Token Compression for Omni-LLMs

    Jul 23, 2026Suho Yoo, Youngjoon Jang, Hyebin Cho +1Token CompressionOmni-Modal

  32. Visual Token Compression Enhances Robustness of MLLMs

    Jul 21, 2026Shishen Gu, Jiequan Cui, Wenbo Hu +3Visual Token PruningRecent Vision-Language Models

  33. VisCo: Leveraging Large Language Models as Intrinsic Encoders for Visual Token Compression

    Jul 14, 2026Yupeng Zheng, Kai Zou, Bin Liu +1Token CompressionData Compression Methods

  34. GeoTrace: Geometry-Aware Trajectory Token Compression for Video Large Language Models

    Jul 10, 2026Guohuan Xie, Mengqi Lei, Chuan Shi +3Token CompressionGeogs-Slam

  35. OmniFocus: Query-Guided Modality-Balanced Token Compression for Omni-Modal Large Language Models

    Jul 3, 2026Shijie Cao, Qingyu Zhang, Boxi Yu +6Token CompressionAudio-Visual Reasoning

  36. STAC: Selective Spatiotemporal Aggregation and Compression for Video Reasoning Segmentation

    Jul 3, 2026Syed Ariff Syed Hesham, Yun Liu, Guolei Sun +4Spatial TokensToken Compression

  37. When Token Compression Breaks: Structural Pruning vs. Token Reduction for Robust ViT Segmentation under High Compression

    Jul 2, 2026Tien-Phat Nguyen, Ngai-Man CheungToken CompressionSelf-Supervised Vision Transformers

  38. DinoLink: A Token-Centric Representation Compression Framework for Bandwidth-Constrained Collaborative V2X Perception

    Jun 24, 2026Tianle Zhu, Haohua Que, Handong Yao +2V2XToken Compression

  39. AVOC: Enhancing Hour-Level Audio-Video Understanding in Omni-Modal LLMs via Retrieval-Inspired Token Compression

    Jun 23, 2026Yijing Chen, Wenhui Tan, Xiaoyi Yu +7Audio-Visual ReasoningLarge Audio Language Models

  40. CoreMem: Riemannian Retrieval and Fisher-Guided Distillation for Long-Term Memory in Dialogue Agents

    Jun 16, 2026Jiaqi Chen, Yongqin Zeng, Shaoshen Chen +4Peak MemoryLong-Term Memory

  41. HiLo-Token: Input-Adaptive High-Low Frequency Token Compression for Efficient Image Editing

    Jun 11, 2026Haoran You, Yotam Nitzan, Lingzhi Zhang +7Diffusion-Based Image EditingImage Editing

  42. Beyond Uniform Tokens: Adaptive Compression for Time Series Language Models

    Jun 11, 2026Jialin Gan, Xin Qiu, Guangzhe Chen +1Token CompressionTime Series

  43. Adaptive Multi-Resolution Procedural Knowledge Compression for Large Language Models

    Jun 10, 2026Changyue Wang, Weihang Su, Qingyao Ai +5LLM Inference OptimizationToken Compression

  44. Planning-aligned Token Compression for Long-Context Autonomous Driving

    Jun 5, 2026Zhixuan Liang, Yuxiao Chen, Yurong You +12Token CompressionAutonomous Driving

  45. Entropy Gate: Entropy Quenching for Near-Lossless Token Compression in LLM Pipelines

    Jun 2, 2026Justice Owusu Agyemang, Jerry John Kponyo, Kwame Opuni-Boachie Obour Agyekum +3Token CompressionToken-Level Entropy

  46. InfoMerge: Information-aware Token Compression for Efficient Video Large Language Models

    Jun 1, 2026Xinxin Liu, Shiwei Gan, Xiao Liu +3Token CompressionVideo-Language Models

  47. EvoCut: Multi-Layer Evolution-Aware Visual Token Compression for Efficient Large Vision-Language Models

    Jun 1, 2026Hongyu Lu, Feng Zhang, Wenwei Jin +5Token CompressionVision Encoders

  48. ETC: Extreme Token Compression via Task-aware Visual Information Distillation in VLMs

    May 30, 2026Yiling Gao, Hongchen Wei, Zhenzhong ChenToken CompressionDataset Distillation

  49. PARCEL: Pool-Anchored Resampling with Conditioned Elastic Queries for Efficient Vision-Language Understanding

    May 28, 2026Selim Kuzucu, Alessio Tonioni, Vasile Lup +3Token CompressionRecent Vision-Language Models

  50. EarlyTom: Early Token Compression Completes Fast Video Understanding

    May 28, 2026Hesong Wang, Xin Jin, Lu Lu +4Token CompressionVision Encoders

  51. Accelerating Constrained Decoding with Token Space Compression

    May 28, 2026Michael Sullivan, Alexander KollerToken CompressionContext-Free Grammars

  52. BitC-3DGS: High-Capacity 3D Gaussian Splatting Watermarking via Bit Compression

    May 28, 2026Yuquan Bi, Baosheng Yu, Yingke Lei +5WatermarksToken Compression

  53. AGORA: Adapter-Grounded Observation-Action Retention for Inference-Free Prompt Compression in LLM Agents

    May 26, 2026Haoran Zhang, Zhaohua SunLarge Language Model AgentsTask-Aware Compression

  54. Efficient One-Step Diffusion Restoration Model with Compact Token Compression and Linear Attention

    May 22, 2026Bingtian Qiao, Yue Shi, Yingjie Zhou +3Real-World Image Super-ResolutionImage Restoration

  55. DynaTok: Temporally Adaptive and Positional Bias-Aware Token Compression for Video-LLMs

    May 19, 2026Minyoung Park, Taehun Kong, Sangjun AhnToken CompressionVideo Compression