Context Length

Momentum

4 papers in the last four weeks, up 33% on the four weeks before. 0.0% of all new papers.

Jul 6Week of Sep 21

Latest papers 28

All topics
CardsList
  1. CoEM: Empowering Long-Context Reasoning with Commit-on-Evidence Memory

    Sep 29, 2026Jingguang Li, Yebo Wu, Zuyi Guo +7Long-Context ReasoningLLM Reasoning Strategies

  2. KV-streams for Efficient Compaction in Agentic Reinforcement Learning

    Sep 28, 2026Emiliano Penaloza, Dane Malenfant, Dheeraj Vattikonda +15CompactionAgentic Reinforcement Learning

  3. Where Activation Sparsity and KV-Cache Sparsity Cross in LLM Decoding

    Sep 27, 2026Jungseob Lee, Seungyoon Lee, Seongtae Hong +2Dynamic Sparse AttentionLarge Language Model Decoding

  4. Uncheatable Eval: Dynamic Compression-Based Evaluation of Language Models

    Sep 23, 2026Kaifeng Tan, Yudong Li, Linlin ShenContext LengthData Compression Methods

  5. Distance generalization in transformers: why bother with positional encoding?

    Sep 11, 2026Daniel Henrik Nevermann, Claudius GrosPositional EncodingTransformer Architectures

  6. HeadWiseKV: Budgeted Per-Head Cache Residency for Hybrid Long-Context Language Models

    Sep 2, 2026Renjie Xie, Juncheng Yang, Aoting Hu +4Efficient Long-Context InferenceKey-Value Cache

  7. VLZip: Unified Visual and Textual Compression for Interleaved Long-Context Modeling

    Aug 9, 2026Yuqi Zhang, Cheng Chen, Yuyu Guo +6Recent Vision-Language ModelsEfficient Long-Context Inference

  8. Sequential Correlations Change In-Context Learning: Effective Context Length and Architectural Mismatch

    Jul 4, 2026Mary Letey, Yue M. Lu, Cengiz Pehlevan +1In-Context LearningSequence Modeling

  9. BamiBERT: A New BERT-based Language Model for Vietnamese

    Jul 2, 2026Dat Quoc Nguyen, Thinh Pham, Chi Tran +1Bert-Based ModelsLanguage Modeling

  10. KVEraser: Learning to Steer KV Cache for Efficient Localized Context Erasing

    Jun 15, 2026Mufei Li, Shikun Liu, Dongqi Fu +5Kv-Cache ManagementKey-Value Cache

  11. Training and Evaluating Diffusion Policies with Long Context Lengths

    Jun 15, 2026Abhinav Agarwal, Adam Wei, Taylan Kargin +6Imitation LearningDiffusion Policies

  12. A Large-Scale Multi-Dimensional Empirical Study of LLMs for Conversation Summarization

    Jun 14, 2026Weixiao Zhou, Gengyao Li, Xianfu Cheng +3SummarizationFact-Checking

  13. End-to-End Context Compression at Scale

    Jun 8, 2026Ang Li, Sean McLeish, Haozhe Chen +12Efficient Long-Context InferenceContext Length

  14. Separating Semantic Competition from Context Length in RAG Reading

    May 26, 2026Vyzantinos Repantis, Ameya Gawde, Harshvardhan Singh +4Question-Answering BenchmarksContext Length

  15. LiteFrame: Efficient Vision Encoders Unlock Frame Scaling in Video LLMs

    May 17, 2026Jihwan Kim, Nikhil Parthasarathy, Danfeng Qin +5Vision EncodersContext Length

  16. EndPrompt: Efficient Long-Context Extension via Terminal Anchoring

    May 14, 2026Han Tian, Luxuan Chen, Xinran Chen +10Efficient Long-Context InferenceContext Length

  17. Classifier Context Rot: Monitor Performance Degrades with Context Length

    May 12, 2026Sam Martin, Fabien RogerContext LengthAgentic Benchmarks

  18. On Problems of Implicit Context Compression for Software Engineering Agents

    May 11, 2026Kirill Gelvan, Igor Slinko, Felix Steinbauer +3Context LengthLarge Language Model Backbones

  19. Evaluating LLMs on Large-Scale Graph Property Estimation via Random Walks

    May 2, 2026Sunil Kumar Maurya, Xin LiuLLM Reasoning StrategiesLarge Language Model Evaluation

  20. BERAG: Bayesian Ensemble Retrieval-Augmented Generation for Knowledge-based Visual Question Answering

    Apr 24, 2026Jinghong Chen, Jingbiao Mei, Guangyu Yang +1Knowledge-Based Visual Question AnsweringContext Length

  21. Beyond Sequential Distance: Inter-Modal Distance Invariant Position Encoding

    Mar 11, 2026Lin Chen, Bolin Ni, Qi Yang +5Cross-Modal AttentionRotary Position Embedding

  22. CompLLM: Compression for Long Context Q&A

    Sep 23, 2025Gabriele Berton, Jayakrishnan Unnikrishnan, Son Tran +1Efficient Long-Context InferenceLarge Language Model Compression