Long-Context Modeling

Latest papers 105

All topics
CardsList
  1. SynthDocBench: Controlled Benchmark for Long-Context Visual Document Understanding

    Jul 11, 2026Abhigya Verma, Khyati Mahajan, Amit Kumar Saha +4VLM EvaluationVision-Language Models

  2. DSSMs: State Space Models with Explicit Memory via Delay Differential Equations

    Jul 11, 2026Yixiao Qian, Song Chen, Jiaxu Liu +2Dynamical SystemsLong-Context Modeling

  3. Hierarchical Sparse Attention Done Right: Toward Infinite Context Modeling

    Jul 3, 2026Xiang Hu, Xinyu Wei, Hao Gu +10Long-Context Language Model InferenceLong-Context Language Modeling

  4. PraMem: Practice-derived Experiential Memory for Long-horizon Behavior Prediction

    Jul 3, 2026Zhuoqun Li, Boxi Cao, Jiawei Chen +11Memory-Augmented Language ModelsNext-Action Prediction

  5. Can Language Models Actually Retrieve In-Context? Drowning in Documents at Million Token Scale

    Jul 1, 2026Siddharth Gollapudi, Nilesh Gupta, Prasann Singhal +1In-Context RetrievalLength Generalization

  6. Multi-Head Recurrent Memory Agents

    Jul 1, 2026Jiatong Li, Samuel Yeh, Sharon LiLLM MemoryLong-Context Modeling

  7. Hierarchical Global Attention (HGA)

    Jun 29, 2026Woernle Frank, Fedosov Vladimir, Grinenko ArtemiyKV-Cache OffloadingLong-Context Modeling

  8. MuonSSM: Orthogonalizing State Space Models for Sequence Modeling

    Jun 29, 2026Thai-Khanh Nguyen, Ngoc-Bich-Uyen Vo, Thieu N. Vo +2Long-Context ModelingSequence Modeling

  9. Diagnosing and Mitigating Context Rot in Long-horizon Search

    Jun 29, 2026Shijie Xia, Yikun Wang, Zhen Huang +1Long-Context ModelingLLM Context Management

  10. The Verbose Context Problem in Medical Records

    Jun 28, 2026Shiva Kaul, Min-Gyu Kim, Anjum Khurshid +1Long-Context ModelingLongitudinal EHR Modeling

  11. How Token Influence Decays with Distance: A Green-Function View of Trained Language Models

    Jun 28, 2026Matthias Brändel, Stephan Köhler, Oliver RheinbachTransformer InterpretabilityAutoregressive Language Modeling

  12. Scaling State-Space Models from Lines to Paragraphs: An Ablation of Mamba-based OCR

    Jun 22, 2026Merveilles Agbeti-Messan, Pierrick Tranouez, Stéphane Nicolas +2Selective SSMsLong-Context Modeling

  13. moBERTo: A Modern Encoder for Portuguese via Continued Pretraining of ModernBERT

    Jun 21, 2026Thiago Laitz, Thales Sales Almeida, João Guilherme Alves Santos +1Language Model PretrainingLong-Context Modeling

  14. HPP: Hierarchical Programmatic Probing for Long Video Understanding by Decoupling Perception and Reasoning

    Jun 19, 2026Awais Rauf, Ahmed Hasssan, Greg SlabaughVideo UnderstandingLong-Context Modeling

  15. How Well Can Your Video Model Remember? Measuring Memory-Budget Trade-offs in Long Video Understanding

    Jun 17, 2026Yixian TianVLM EvaluationStreaming Video Understanding

  16. Training and Evaluating Diffusion Policies with Long Context Lengths

    Jun 15, 2026Abhinav Agarwal, Adam Wei, Taylan Kargin +6Diffusion PolicyLong-Context Modeling

  17. Rethinking the Role of Efficient Attention in Hybrid Architectures

    Jun 13, 2026Ziqing Qiao, Yinuo Xu, Chaojun Xiao +6Attention Head AnalysisLong-Context Modeling

  18. LongSpike: Fractional Order Spiking State Space Models for Efficient Long Sequence Learning

    Jun 11, 2026Xinrui He, Qiyu Kang, Xuhao Li +1Long-Context ModelingSpiking Neural Networks

  19. Context-Driven Incremental Compression for Multi-Turn Dialogue Generation

    Jun 10, 2026Yeongseo Jung, Jaehyeok Kim, Eunseo Jung +5Memory-Augmented Language ModelsLong-Context Modeling

  20. Attention Expansion: Enhancing Keyphrase Extraction from Long Documents with Attention-Augmented Contextualized Embeddings

    Jun 9, 2026Roberto Martínez-Cruz, Alvaro J. López-López, José PortelaDocument Information ExtractionLong-Context Modeling

  21. Kwai Keye-VL-2.0 Technical Report

    Jun 9, 2026Kwai Keye Team, Bin Wen, Changyi Liu +50Temporal Video GroundingLong-Context Modeling

  22. MMLongEmbed: Benchmarking Multimodal Embedding Models in Long-Context Scenarios

    Jun 5, 2026Haitian Wang, Ruoxi Sun, Quantong Qiu +5Multimodal IRMultimodal Embedding

  23. EASE-TTT: Evidence-Aligned Selective Test-Time Training for Long-Context Question Answering

    Jun 5, 2026Xiaopeng Yuan, Zebin Wang, Suwen Wang +3Long-Context RetrievalLong-Context QA