Task-Aware Compression

Latest papers 55

All topics
CardsList
  1. Q-SPT: Learnable Query-Based Compression for Low-Frame-Rate Speech Tokenization

    Oct 1, 2026Jeeyoung Yun, Seohwan Yun, Sungwoong KimNeural Speech CodecsAudio Tokenizers

  2. Sequential Functional Structured Tucker Compression for Large Language Model Attentions

    Sep 30, 2026Jiangfeng Chen, Xinyu Wang, Tianshuo Yan +4Large Language Model CompressionTask-Aware Compression

  3. ResComEmb: Effective and Efficient Multimodal Embedding via Residual Homogeneity Compression

    Sep 29, 2026Zijing Cai, Yuzhe Wang, Jingxian Zhu +2Multimodal EmbeddingsTask-Aware Compression

  4. The Hidden Perception Constraint in Task-Aware Compression

    Sep 28, 2026Sahan Liyanaarachchi, Semih Akkoc, Sennur Ulukus +1Task-Aware CompressionPerceptual Quality

  5. Revisiting Distributed Sign-Based Variance Reduction

    Sep 16, 2026Wei Jiang, Zechao Li, Lijun ZhangDecentralized OptimizationVariance Reduction

  6. LACE: Layer-Wise Compression for Dynamic Frame Rate Codecs

    Sep 15, 2026Thanapat Trachu, Samuele Cornell, William Chen +1Frame RateVideo Coding

  7. Dynamic Semantic Compression for Efficient Latent-Space Inference in Large Language Models

    Sep 14, 2026Peipei Li, Dongsen Zhang, Yuchen Liu +1LLM Inference OptimizationTask-Aware Compression

  8. Memory Compression for High-Fanout Agent Sandboxes

    Sep 12, 2026Mengming Li, Ceyu XU, Qijun Zhang +4SandboxTask-Aware Compression

  9. Photonic reservoir computing with dimensionally compressed readout

    Sep 7, 2026Gerald Kobi, Mohab Abdalla, Miguel C. Soriano +1Reservoir ComputingReservoir

  10. Can LLMs Design Video Coding Tools? A Case Study on Planar Mode

    Sep 1, 2026Yingwen Zhang, Meng Wang, Liqiang He +1Video CodingVideo-Language Models

  11. Multivariate Scientific Data Compression with Learned Cross-Variable Latent Decorrelation and Autoregressive Entropy Modeling

    Aug 31, 2026Liangji Zhu, Anand Rangarajan, Sanjay RankaTask-Aware CompressionData Compression Methods

  12. Breaking the Compression Barrier: Cross-Architecture Compression Boundary Learning via Reverse Regrowth

    Aug 17, 2026Zhaocen Liu, Satvik Praveen, Yi ShengCompressed ModelTask-Aware Compression

  13. TACTICL: Task-Aware Compression of Tabular ICL Models

    Aug 11, 2026Mykhailo Koshil, Matthias Feurer, Katharina EggenspergerTabular Foundation ModelsTask-Aware Compression

  14. Decision-Aware Approximation of Belief Functions for Evidential Combinatorial Optimization

    Aug 11, 2026Sohaib AfifiCombinatorial OptimizationApproximation

  15. Think in Sets for Streaming Video Token Compression

    Aug 2, 2026Moxu Duan, Jingwen Fu, Yuwang WangToken CompressionTask-Aware Compression

  16. LLM-based Source Code Compression via Thresholded Symbol Ranking

    Jul 27, 2026Angelo Nardone, Paolo FerraginaLarge Language Model CompressionTask-Aware Compression

  17. Twin Agent: Context Residual Compression for Privilege Separated Agents

    Jul 21, 2026Zhanhao Hu, Dennis Jacob, Xiao Huang +3Indirect Prompt InjectionTask-Aware Compression

  18. Compression Asymmetry and Trajectory Binding in Noise-Anchored Diffusion Inversion

    Jul 8, 2026Yongseong Park, Joeun Kim, HoEun Kim +1Diffusion InversionInverse Design

  19. Empirical Minimal-Realisation Compression of Deep Neural Networks via Controllability-Observability Tests

    Jul 5, 2026Anis Hamadouche, Amir HussainNeural NetworkTask-Aware Compression

  20. OmniFocus: Query-Guided Modality-Balanced Token Compression for Omni-Modal Large Language Models

    Jul 3, 2026Shijie Cao, Qingyu Zhang, Boxi Yu +6Token CompressionAudio-Visual Reasoning

  21. HASTE: A Framework for Training-Free, Dynamic, and Steerable Compression of Pre-Trained Convolutional Neural Networks

    Jun 29, 2026Lukas Meiner, Jens Mehnert, Alexandru Paul ConduracheTask-Aware CompressionConvolutional

  22. UniRank: Unified Rank Allocation for Low-Rank LLM Compression

    Jun 20, 2026Chao Han, Yongjie Du, Junjie Tan +1Large Language Model CompressionTask-Aware Compression

  23. RegimeVGGT: Layer-Wise Spatially Preserving Redundancy Removal for Visual Geometry Grounded Transformer

    Jun 16, 2026Jinhao You, Shuo Lyu, Zhuohang Lyu +5Visual Geometry Grounded TransformerSelf-Supervised Vision Transformers

  24. MemoryVAM: Integrating Memory into Video Action Model for Robot Manipulation

    Jun 13, 2026Yuxin Jiang, Chang Yu, Yunuo Chen +4Efficient World-Action ModelRobotic Manipulation

  25. Can Deep Neural Networks Improve Compression of Very Large Scientific Data?

    Jun 12, 2026Muhannad Alhumaidi, Guozhong Li, Spiros Skiadopoulos +1Task-Aware CompressionData Compression Methods

  26. Context-Driven Incremental Compression for Multi-Turn Dialogue Generation

    Jun 10, 2026Yeongseo Jung, Jaehyeok Kim, Eunseo Jung +5Dialogue BenchmarksEfficient Long-Context Inference

  27. REACH: Interpretability-Driven Feature Identification and Architecture Compression for Multi-Channel Vehicular Channel Estimation

    Jun 10, 2026Simbarashe Aldrin Ngorima, Albert Helberg, Marelie H. DavelChannel EstimationChannel

  28. Towards Data-free and Training-free Compression for Speech Foundation Models Using Parameter Clustering

    Jun 10, 2026Haoning Xu, Zhaoqing Li, Huimeng Wang +4Task-Aware CompressionUnstructured Pruning

  29. Predictive Assistance and the Temporal Dynamics of Exploratory Compression

    Jun 8, 2026Balaraju BattuPredictive CodingStochastic Exploration

  30. From Long News to Accurate Forecast: Importance-Aware Fusion and PRM-Guided Reflection for Time Series Forecasting

    Jun 2, 2026Mingyang Liu, Qingcan Kang, Yuke Wang +6Large Language Model ForecastingTime Series Forecasting

  31. Spatially Distributed Task-Oriented Compression for Multi-Emitter Localization and Characterization with Spectral Overlap

    May 31, 2026H. Nazim Bicer, J. Nicholas LanemanTask-Aware CompressionData Compression Methods

  32. AGORA: Adapter-Grounded Observation-Action Retention for Inference-Free Prompt Compression in LLM Agents

    May 26, 2026Haoran Zhang, Zhaohua SunLarge Language Model AgentsTask-Aware Compression

  33. The Extremum Stack is a Minimal Sufficient Statistic for Rate-Independent Functionals: A Kolmogorov Complexity Characterisation

    May 16, 2026Piotr FrydrychTask-Aware CompressionExtremes

  34. CoRDS: Coreset-based Representative and Diverse Selection for Streaming Video Understanding

    May 14, 2026Ailar Mahdizadeh, Puria Azadi, Muchen Li +2Streaming Video UnderstandingKey-Value Cache Compression

  35. Prospective Compression in Human Abstraction Learning

    May 11, 2026Leonardo Hernandez Cano, Ivan Zareski, Luisa El Amouri +6LearnTask-Aware Compression

  36. Activation Compression in LLMs: Theoretical Analysis and Efficient Algorithm

    May 2, 2026Wen-Da Wei, Han-Bin Fang, Yang-Di Liu +3Large Language Model CompressionTask-Aware Compression

  37. Auto-FlexSwitch: Efficient Dynamic Model Merging via Learnable Task Vector Compression

    Apr 30, 2026Junqi Gao, Dazhi Zhang, Zhichang Guo +3Continual Model MergingTask-Aware Compression

  38. Compressing Sequences in the Latent Embedding Space: KK-Token Merging for Large Language Models

    Apr 16, 2026Zihao Xu, John Harvill, Ziwei Fan +3Large Language Model CompressionTask-Aware Compression

  39. A Synonymous Variational Perspective on the Rate-Distortion-Perception Tradeoff

    Apr 16, 2026Zijian Liang, Kai Niu, Changshuo Wang +2Rate-Distortion TheoryTask-Aware Compression

  40. Unsupervised Behavioral Compression: Learning Low-Dimensional Policy Manifolds through State-Occupancy Matching

    Mar 27, 2026Andrea Fraschini, Davide Tenedini, Riccardo Zamboni +2Task-Aware CompressionOccupancy

  41. Dataset Distillation Efficiently Encodes Low-Dimensional Representations from Gradient-Based Learning of Non-Linear Tasks

    Mar 16, 2026Yuri Kinoshita, Naoki Nishikawa, Taro ToyoizumiDiffusion-Based Dataset DistillationDataset Distillation

  42. EchoingPixels: Aliasing-Resistant Joint Token Reduction for Audio-Visual LLMs

    Dec 11, 2025Chao Gong, Depeng Wang, Zhipeng Wei +3Large Audio Language ModelsPerceptual Aliasing

  43. EDGC: Entropy-driven Dynamic Gradient Compression for Efficient LLM Training

    Nov 13, 2025Qingao Yi, Jiaang Duan, Jun Zhang +5Large Language Model TrainingTask-Aware Compression

  44. GeLaCo: An Evolutionary Approach to Layer Compression

    Jul 14, 2025David Ponce, Thierry Etchegoyhen, Javier Del SerLarge Language Model CompressionCompressed Model

  45. Task Vector Bases: A Unified and Scalable Framework for Compressed Task Arithmetic

    Feb 3, 2025Siqi Zeng, Yifei He, Meitong Liu +5Task-Aware CompressionData Compression Methods

  46. QABBA: Symbolic Time-Series Compression via Integer-Quantized Aggregation

    Nov 20, 2024Erin Carson, Xinye Chen, Fei He +1Task-Aware CompressionData Compression Methods

  47. UniTAC: Universal Task-Aware Compression via Weighted Distortion Measures

    Date pendingHoma Esfahanizadeh, Matin Mortaheb, Adeel Mahmood +2Task-Aware CompressionData Compression Methods