Context Compression

Momentum

13 papers in the last four weeks, up 160% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 57

All topics
CardsList
  1. ReFold: Training-Free Reversible Inter-Turn Context Folding for Long-Horizon Agents

    Oct 6, 2026Yupeng Su, Jiayi Tian, Zheng Zhang +1LLM Inference EfficiencyLong-Context Language Model Inference

  2. FOCUS: Training-Free Decision-Preserving Context Compression for LLM Agents

    Sep 29, 2026Shantanu Dixit, Anson Bastos, Xuchao Zhang +2Long-Horizon LLM AgentsLLM Context Management

  3. CADOC: Cache-Aware Dynamic Object Context for Long-Horizon Agents

    Sep 29, 2026Junjie Yao, Zhangchen Zhou, Zhi-Qin John XuCost-Aware InferencePrefix Caching

  4. KV-streams for Efficient Compaction in Agentic Reinforcement Learning

    Sep 28, 2026Emiliano Penaloza, Dane Malenfant, Dheeraj Vattikonda +15Agentic RLKV-Cache Management

  5. Scalable In-Context Reinforcement Learning with Recurrent Algorithm Distillation

    Sep 28, 2026Yuanqing Ma, Zhenrui Zheng, Chenjun XiaoTransformerIn-Context RL

  6. Instance-Adaptive Prompts as Context for Time-Series Foundation Models

    Sep 28, 2026Zehao Xiao, Shifeng Xie, Lei Zan +5Time Series ForecastingPrompt Tuning

  7. When Can Agents Forget Their Reasoning? ICLR for Long-Horizon Agent Context Compression

    Sep 24, 2026Mingxuan Wang, Fei Luo, Bo Wang +6Long-Context ModelingLong-Horizon LLM Agents

  8. MORSE: Multi-Context Ordering via Reverse Scoring for Evidence-Preserving Compression

    Sep 23, 2026Ke Wan, Yifan Wang, Liheng Lai +1Retrieval-Augmented GenerationEvidence Retrieval

  9. CliffCompaction: Cost-Efficient Compaction for Long-Horizon Coding Agents

    Sep 22, 2026Trang Nguyen, Eulrang Cho, Bingqing Chen +1Continual Learning for LLM AgentsTest-Time Scaling

  10. Compressing Long Context into Answer-Aligned Memory Embeddings for LLM Inference

    Sep 22, 2026Md Mostafizer Rahman, Md Faizul Ibne Amin, Md Shahajada Mia +2LLM Inference EfficiencyLong-Context Language Model Inference

  11. FlexComp: One Model for Every Ratio in Context Compression

    Sep 11, 2026Kaiyan Zhao, Zhongtao Miao, Akiko Aizawa +1LLM Inference AccelerationContext Compression

  12. LatentPress: Context Compression Beyond Text and Vision

    Sep 1, 2026Zhengze Zhou, Hejian SangLLM Inference AccelerationLLM Context Management

  13. SkillZip Pro: Execution-Aware Dynamic Compression of Progressively Loaded Skills for Self-Evolving Agents

    Aug 31, 2026Xiaofan Bai, Chao Liu, Hongqiang Lin +5Context Compression

  14. Balanced Adaptive Prototype Selection for Scalable TabPFN Inference on Large-Scale Tabular Data

    Aug 13, 2026Mahboobe Jadid, Melika Rezaye Garkani, Ali MousaviTabular Foundation ModelsTabular ICL

  15. Toward Reliable Context Compression for Long-Horizon Agents: An Empirical Study of Execution Instability

    Aug 6, 2026Guanghui Min, Liang Wu, Mayank Darbari +2AI Agent EvaluationLong-Horizon LLM Agents

  16. Context Compaction Theory

    Aug 2, 2026Hayder Tirmazi, Sam Markelon, Allison Bishop +1LLM Context ManagementContext Compression

  17. Addressable Recall Compaction for Long Context-Window Control in AI Agents

    Jul 27, 2026Thang Dang, Yuma Ichikawa, Sakina Fatima +1Long-Horizon LLM AgentsLLM Context Management

  18. Twin Agent: Context Residual Compression for Privilege Separated Agents

    Jul 21, 2026Zhanhao Hu, Dennis Jacob, Xiao Huang +3AI Agent SecurityLLM Agent Security

  19. Token Reduction Is Not Cost Reduction

    Jul 13, 2026Sarel Weinberger, Amir HozezAI Coding AgentsCost-Aware Inference

  20. CompactionRL: Reinforcement Learning with Context Compaction for Long-Horizon Agents

    Jul 6, 2026Yujiang Li, Zhenyu Hou, Yi Jing +2Software Engineering AgentsLong-Horizon LLM Agents

  21. ACE: Pluggable Adaptive Context Elasticizer across Agents

    Jun 30, 2026Ning Liao, Zihao Long, Xiaoxing Wang +6Long-Horizon LLM AgentsLLM Context Management

  22. Database Context Compression for Text-to-SQL on Real-World Large Databases

    Jun 26, 2026Jingwen Liu, Weibin Liao, Xin Gao +2Text-to-SQLRelational Databases

  23. Compression and Retrieval: Implicit Memory Retrieval for Video World Models

    Jun 22, 2026Zhan Peng, Jie Ma, Huiqiang Sun +6Long-Horizon Video GenerationMemory-Augmented Video Generation

  24. Fixed RAG Compression Collapses Measured Reader Scaling

    Jun 20, 2026Sugam Panthi, Rabab AbdelfattahRetrieval-Augmented GenerationLLM Evaluation

  25. TokenPilot: Cache-Efficient Context Management for LLM Agents

    Jun 15, 2026Buqiang Xu, Zirui Xue, Dianmou Chen +12LLM Agent MemoryKV-Cache Management

  26. Context Compression Is Not One Thing: Readable Symbolic Re-expression vs. Coherent Summary at Matched Budget

    Jun 12, 2026Sisong Bei, Mikhail L. Arbuzov, Ziwei Dong +2Multi-Hop QAContext Compression

  27. End-to-End Context Compression at Scale

    Jun 8, 2026Ang Li, Sean McLeish, Haozhe Chen +12LLM CompressionLong-Context Language Model Inference

  28. Signal-Driven Observation for Long-Horizon Web Agents

    Jun 4, 2026Shubham Gaur, Ian LaneActive PerceptionLong-Horizon LLM Agents

  29. From Long News to Accurate Forecast: Importance-Aware Fusion and PRM-Guided Reflection for Time Series Forecasting

    Jun 2, 2026Mingyang Liu, Qingcan Kang, Yuke Wang +6Process Reward ModelsFinancial Forecasting

  30. Thinking as Compression: Your Reasoning Model is Secretly a Context Compressor

    May 27, 2026Guoxin Ma, Yibing Liu, Chengzhengxu Li +7LLM CompressionLong-Context Inference

  31. Neural Router: Semantic Content Matching for Agentic AI

    May 25, 2026Lauri Lovén, Abhishek Kumar, Alexander Engelhardt +5Semantic Textual SimilarityLLM Inference Acceleration

  32. SemanticZip: A Pilot Framework for Lossy Text Compression with LLMs as Semantic Decompressors

    May 23, 2026Natalia Trukhina, Vadim VashkelisContext Compression

  33. On Problems of Implicit Context Compression for Software Engineering Agents

    May 11, 2026Kirill Gelvan, Igor Slinko, Felix Steinbauer +3Software Engineering AgentsLong-Horizon LLM Agents

  34. Beyond Position Bias: Shifting Context Compression from Position-Driven to Semantic-Driven

    May 10, 2026Jiwei Tang, Zhijing Huang, Xinyu Zhang +5LLM CompressionPosition Bias

  35. GRC: Unifying Reasoning-Driven Generation, Retrieval and Compression

    May 9, 2026Zhongtao Miao, Qiyu Wu, Yoshimasa TsuruokaRetrieval-Augmented GenerationMemory-Augmented Language Models

  36. MiA-Signature: Approximating Global Activation for Long-Context Understanding

    May 7, 2026Yuqing Li, Jiangnan Li, Mo Yu +3Long-Context ModelingContext Compression

  37. Kwai Summary Attention Technical Report

    Apr 27, 2026Chenglong Chu, Guorui Zhou, Guowang Zhang +35Self-AttentionKV Caching

  38. ResRank: Unifying Retrieval and Listwise Reranking via End-to-End Joint Training with Residual Passage Compression

    Apr 24, 2026Xiaojie Ke, Shuai Zhang, Liansheng Sun +6Learning to RankLLM Reranking

  39. A Self-Evolving Framework for Efficient Terminal Agents via Observational Context Compression

    Apr 21, 2026Jincheng Ren, Siwei Wu, Yizhi Li +8Terminal AgentsLong-Horizon Agent Tasks

  40. EnComp: Lightweight Encoder-Only Context Compression for Retrieval-Augmented Question Answering

    Mar 10, 2026Thao Do, Dinh Phu Tran, An Vo +2Efficient Language Model InferenceKnowledge-Intensive QA

  41. BudgetMem: Training-Free Selective Memory for Cost-Efficient Long-Context Processing in Language Models

    Nov 7, 2025Chandra Vamsi Krishna Alla, Harish Naidu Gaddam, Manohar Kommi +1LLM CompressionLong-Context Language Model Inference

  42. CompLLM: Compression for Long Context Q&A

    Sep 23, 2025Gabriele Berton, Jayakrishnan Unnikrishnan, Son Tran +1LLM CompressionLong-Context Language Model Inference

  43. InComeS: Integrating Compression and Selection Mechanisms into LLMs for Efficient Model Editing

    May 28, 2025Shuaiyi Li, Zhisong Zhang, Yang Deng +6In-Context LearningModel Editing

  44. SeDeM: Selective Decompression of Hidden-State Memories for Long-Context Question Answering

    Date pendingMaryam Haghifam, Jason Cong, Yizhou SunMemory-Augmented Language ModelsLong-Context QA