Prompt Compression

Momentum

1 paper in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 24

All topics
CardsList
  1. How Much Prompt Is Enough? A Blackbox Minimization of Few-Shots in LLMs

    Sep 28, 2026Ali Alfageeh, Rahul Gopinath, Amin AlipourLLM PromptingFew-Shot Prompting

  2. Relevant but Incomplete: Referential Dangling as a Paradigm-Level Failure Mode in Hard Prompt Compression

    Aug 5, 2026Zhengpei Hu, Kai Li, Dapeng Fu +5LLM CompressionLong-Context Inference

  3. Control Under Compression: Reliability Frontiers for Tool-Using Agents

    Aug 2, 2026Yinghan Hou, Zongyou YangAI Agent ReliabilityAI Agent Benchmarks

  4. SALT: Salience-Aware Lexical Trie for Long-Context Compression

    Jul 20, 2026Oteo Mamo, Hyunjin Yi, Joydhriti Choudhury +2LLM CompressionLong-Context Language Model Inference

  5. Prompt Compression via Activation Aggregation

    Jul 9, 2026Thibaud Ardoin, Semira Einsele, Evis Bregu +1LLM Inference AccelerationRepresentation Geometry in Language Models

  6. What to Keep, What to Forget: A Rate--Distortion View of Memory Compaction in LLMs and Agents

    Jul 9, 2026Ashwin Gerard Colaco, Nada LahjoujiRate-Distortion TheoryLLM Memory

  7. CAVEWOMAN: How Large Language Models Behave Under Linguistic Input and Output Compression

    Jun 23, 2026Morayo Danielle Adeyemi, Ryan A. Rossi, Franck DernoncourtLLM EvaluationLLM Compression

  8. Safe to Check, Unsafe to Use: Relinking at the Compression Boundary of LLM Agents

    Jun 19, 2026Zesen Liu, Zihan Zhang, Dongdong SheAdversarial Attacks on LLMsLLM Agent Security

  9. SoftSkill: Behavioral Compression for Contextual Adaptation

    Jun 18, 2026Xijia Tao, Yihua Teng, Xinyu Fu +6Prompt TuningLLM Agent Skill Learning

  10. Adaptive Multi-Resolution Procedural Knowledge Compression for Large Language Models

    Jun 10, 2026Changyue Wang, Weihang Su, Qingyao Ai +5LLM CompressionEfficient Language Model Inference

  11. Cross-Lingual Token Arbitrage: Optimizing Code Agent Context Windows via Local LLM Preprocessing

    Jun 2, 2026Mehmet Utku ColakAI Coding AgentsLLM Prompting

  12. Token Optimization Strategies for LLM-Based Oracle-to-PostgreSQL Migration

    May 27, 2026Oleg Grynets, Dmytro Babarytskyi, Vasyl LyashkevychToken EfficiencyPrompt Compression

  13. AGORA: Adapter-Grounded Observation-Action Retention for Inference-Free Prompt Compression in LLM Agents

    May 26, 2026Haoran Zhang, Zhaohua SunLLM CompressionLLM Agents

  14. Prompt Compression in Diffusion Large Language Models: Evaluating LLMLingua-2 on LLaDA

    May 18, 2026Sterling Huang, Abigayle Brown, Jiyoo Noh +4LLM EvaluationLLM Compression

  15. From Token to Token Pair: Efficient Prompt Compression for Large Language Models in Clinical Prediction

    May 12, 2026Mingcheng Zhu, Zhiyao Luo, Yu Liu +1LLM CompressionClinical Prediction

  16. Telegraph English: Semantic Prompt Compression via Structured Symbolic Rewriting

    May 6, 2026Mikhail L. Arbuzov, Sisong Bei, Ziwei Dong +2LLM CompressionPrompt Compression

  17. Less is More: Lightweight Prompt Compression for Question Answering Applications on Edge Devices

    Apr 27, 2026Zihuai Xu, Ruofei Hou, Yang Xu +3Retrieval-Augmented GenerationOn-Device Language Model Inference

  18. A Self-Evolving Framework for Efficient Terminal Agents via Observational Context Compression

    Apr 21, 2026Jincheng Ren, Siwei Wu, Yizhi Li +8Terminal AgentsLong-Horizon Agent Tasks

  19. Compressing Sequences in the Latent Embedding Space: KK-Token Merging for Large Language Models

    Apr 16, 2026Zihao Xu, John Harvill, Ziwei Fan +3Token MergingLLM Compression