Long-Context Inference

Latest papers 40

All topics
CardsList
  1. LongHarness Bench: Stress-Testing Language Model Harnesses for Long-Context Reasoning

    Sep 29, 2026Quang Hieu Pham, Thuy Duong Nguyen, Jocelyn Qiaochu Chen +1Long-Context Language Model EvaluationLong-Context Language Model Inference

  2. Realize What Matters: Principled Context Representation for Large-Scale Reasoning

    Sep 23, 2026Michael Theologitis, Dean Light, Shuyue Stella Li +3Long-Context InferenceLLM Context Management

  3. Sliding-window beats linear attention

    Aug 28, 2026Alexia Jolicoeur-Martineau, Rhea Sanjay Sukthanker, Pashmina Cameron +1KV CachingLLM Inference Acceleration

  4. Relevant but Incomplete: Referential Dangling as a Paradigm-Level Failure Mode in Hard Prompt Compression

    Aug 5, 2026Zhengpei Hu, Kai Li, Dapeng Fu +5LLM CompressionLong-Context Inference

  5. ResKV: Reconstructing Omitted Attention Contributions for Fixed-Budget KV Cache Compression

    Jul 31, 2026Yuhang Zhan, Lisi Chen, Shuo ShangSoftmax AttentionKV Caching

  6. C2^2KV: Compressed and Composable KV Cache Reuse for Efficient LLM Inference

    Jul 20, 2026Chuheng Du, Junyi Chen, Hanlin Tang +7KV CachingLLM Inference Acceleration

  7. RECON: Benchmarking Agent Memory for Compositional Reasoning over Long Contexts

    Jul 18, 2026Mihir Shriniwas AryaCompositional ReasoningLLM Agent Memory

  8. Self-Guided Test-Time Training for Long-Context LLMs

    Jul 10, 2026Xinyu Zhu, Zhe Xu, Xiaohan Wei +10Long-Context Language ModelingTest-Time Training

  9. WILDTRACE: Benchmarking Natural Evidence Trails in Long-Context Reasoning

    Jul 10, 2026Zixin Chen, Peng Liu, Haobo Li +7Evidence-Grounded ReasoningLong-Context QA

  10. The Key to Going Linear: Analysis-Driven Transformer Linearization

    Jul 8, 2026Anna Kuzina, Paul N. Whatmough, Babak Ehteshami BejnordiSoftmax AttentionLLM Inference Acceleration

  11. ReContext: Recursive Evidence Replay as LLM Harness for Long-Context Reasoning

    Jul 2, 2026Yanjun Zhao, Ruizhong Qiu, Tianxin Wei +6Long-Context Inference

  12. Information-Aware KV Cache Compression for Long Reasoning

    Jun 25, 2026Jushi Kai, Zhuiri Xiao, Alexandra Birch +1KV CachingLong-Context Language Model Inference

  13. Recursive Agent Harnesses

    Jun 11, 2026Elias Lumer, Sahil Sen, Kevin Paul +1Tool-Augmented Language Model AgentsLLM Agent Orchestration

  14. HMARS: A Hierarchical Multi-Agent Memory System for Long-Context Reasoning

    Jun 3, 2026Zeju Li, Ziyang Zheng, Yizhou Zhou +1Agent MemoryMulti-Agent LLM Systems

  15. LongAttnComp: Cross-Family Context Compression for Long-Context Reasoning

    May 31, 2026Mengmeng Ji, Ravi Shanker Raju, Jonathan Lingjie Li +1LLM CompressionLLM Fine-Tuning

  16. Thinking as Compression: Your Reasoning Model is Secretly a Context Compressor

    May 27, 2026Guoxin Ma, Yibing Liu, Chengzhengxu Li +7LLM CompressionLong-Context Inference

  17. Adaptive Mass-Segmented KV Compression for Long-Context Reasoning

    May 22, 2026Junzhe Yang, Xiaoyu ShenKV CachingLong-Context Language Model Inference

  18. ACC: Compiling Agent Trajectories for Long-Context Training

    May 21, 2026Qisheng Su, Zhen Fang, Shiting Huang +8Supervised Fine-TuningLong-Context Modeling

  19. PEEK: Context Map as an Orientation Cache for Long-Context LLM Agents

    May 19, 2026Zhuohan Gu, Qizheng Zhang, Omar Khattab +1LLM Agent MemoryLong-Context Inference

  20. KV-Fold: One-Step KV-Cache Recurrence for Long-Context Inference

    May 12, 2026Alireza Nadali, Patrick Cooper, Ashutosh Trivedi +1Transformer InferenceKV Caching

  21. Training-Inference Consistent Segmented Execution for Long-Context LLMs

    May 12, 2026Xianpeng Shang, Jiang Li, Zehua Duo +2Self-AttentionLong-Context Language Modeling

  22. The First Drop of Ink: Nonlinear Impact of Misleading Information in Long-Context Reasoning

    May 11, 2026Muhan Gao, Zih-Ching Chen, Kuan-Hao HuangLong-Context InferenceLanguage Model Robustness