12 papers in the last four weeks, up 71% on the four weeks before. 0.1% of all new papers.
Oct 7, 2026·Xiaoran Liu, Ziwei He, Xipeng QiuLong-Context Language ModelingHybrid Attention
Fudan University · Shanghai Innovation Institute · OpenMOSS Team
Oct 6, 2026·Ruijie Li, Jiaxi Hu, Shiyu Wang +1Long-Context ModelingLinear Attention
The Hong Kong University of Science and Technology (Guangzhou) · Independent researcher
Oct 6, 2026·Yuhan Chen, Siyuan Zhang, Nan Wang +2Long-Context Language Model InferenceLLM Inference Acceleration
Virginia Tech · Independent Researcher
Oct 5, 2026·Hyunji Lee, Joykirat Singh, Zaid Khan +5Long-Context Language ModelingRecurrent Transformers
UNC Chapel Hill · The University of Texas at Austin · Mila +1
Oct 5, 2026·Zhuokun Chen, Feng Chen, Xi Lin +4World Model LearningLong-Horizon Video Generation
Monash University · The University of Adelaide · Zhejiang University
Sep 30, 2026·Dong Gyun Kang, Megha Thukral, Kwangsoo KimAttention Head AnalysisOOD Generalization
College of Computing, Georgia Institute of Technology · Department of Transdisciplinary Medicine, Seoul National University Hospital
Sep 29, 2026·Eric Enouen, Sainyam GalhotraIn-Context RetrievalSemantic Search
Cornell University
Sep 29, 2026·Joseph Metcalfe, Sara Sharifzadeh, Fabio CaraffiniRemote Sensing Image SegmentationAgricultural Remote Sensing
Department of Computer Science, Swansea University, Swansea, SA1 8EN, United Kingdom
Sep 29, 2026·Cutter Dawes, Nick Alonso, Tom Figliolia +1Gated AttentionPositional Encoding
Zyphra Research
Sep 28, 2026·Lucas Bandarkar, Junlin Hu, Chenyuan Yang +2Multilingual Language ModelsCross-Lingual Representation Alignment
University of California, Los Angeles · Fudan University
Sep 28, 2026·Zeyu Zhang, Jinyuan Mao, Dakai An +6Real-Time Interactive Video GenerationLong-Horizon Video Generation
DAMO Academy, Alibaba Group · Zhejiang University · Hong Kong University of Science and Technology +2
Sep 27, 2026·Kunming Shao, Jierun Chen, Yanli Wang +4Self-AttentionLLM Inference Acceleration
The Hong Kong University of Science and Technology · Huawei Technologies Ltd. · Sun Yat-sen University +1
Sep 27, 2026·Yirui Liu, Ruoling Qi, Xuaner Wu +6Long-Context Language Model InferenceLLM Inference Acceleration
Institute of Artificial Intelligence, China Telecom (TeleAI) China · Shanghai Jiao Tong University · Individual Researcher +1
Sep 27, 2026·Omin Kwon, JoongWon Shin, Minseo Kim +3LLM Inference AccelerationLinear Attention
Seoul National University · UC Berkeley · KAIST
Sep 22, 2026·Jianyu Wei, Yizhao Gao, Qihao Zhang +12Long-Context RetrievalKV-Cache Management
LLM-Core Xiaomi
Sep 19, 2026·Li Lin, Zhihao Lin, Qi Zhang +3Irregular Time-Series ModelingMultivariate Time Series Forecasting
Southeast University, China · Nanyang Technological University, Singapore · Timecho Ltd., China
Sep 17, 2026·Haocheng Xi, Yiming Xie, Hexu Zhao +8Video Diffusion ModelsStreaming Video Generation
University of California, Berkeley · Impossible, Inc. · University of Texas at Austin
Sep 2, 2026·Runlin Shi, Bojian Yin, Guoqi LiRotary Positional EmbeddingsLinear Attention
Institute of Automation, Chinese Academy of Sciences, Beijing, China
Aug 31, 2026·Yanqi Yu, Pingwei Sun, Jianchao Tan +4KV CachingMemory-Efficient Inference
East China Normal University · Meituan · South China University of Technology
Aug 31, 2026·Yirui Liu, Ruoling Qi, Xuaner Wu +2LLM Inference AccelerationPrefix Caching
Institute of Artificial Intelligence, China Telecom (TeleAI) · Shanghai Jiao Tong University
Aug 20, 2026·Yuting Ge, Pengju Yang, Mingkai NieSelf-AttentionDecoder-Only Language Models
Department of Electrical Engineering City University of Hong Kong · Jilin University · National University of Singapore
Aug 12, 2026·Zunhai Su, Bohan Sun, Xialie Zhuang +8Linear AttentionHybrid Attention
Startlux · Tsinghua University · University of Chinese Academy of Sciences +3
Aug 12, 2026·Zekun Zhou, Ruobing Xie, Lanrui Wang +1Low-Rank Matrix DecompositionGated Attention
Tencent Hunyuan · Peking University
Aug 10, 2026·Aritra Das, Dhruman Gupta, Debayan GuptaLinear AttentionAttention Mechanisms
1Truth Audit Labs
Aug 6, 2026·Jinha Kim, Younghun Roh, Jaeyeon KimBlockwise Diffusion Language ModelsDiffusion Language Model Inference
Apple · *Work done at MIT · Google DeepMind +1
Aug 3, 2026·Li Wang, Yi Su, Xiabao Wu +9Speculative DecodingLLM Inference Acceleration
State Key Laboratory for Novel Software Technology, Nanjing University · Ant Group · Shanghai Jiao Tong University +1
Jul 31, 2026·Pablo Moraes, Monica Rodriguez, Christopher Peters +4Human-Robot InteractionHybrid Attention
Technological University of Uruguay, Uruguay · Ostfalia University of Applied Sciences, Germany
Jul 31, 2026·Yirui Liu, Ruoling Qi, Longwen Wang +5KV CachingLLM Inference Acceleration
Institute of Artificial Intelligence, China Telecom (TeleAI) · Shanghai Jiao Tong University · Xi’an Jiaotong University +1
Jul 30, 2026·Chongjian Ge, Hanwen Jiang, Tianyu Wang +9Video Diffusion ModelsDiffusion Transformer
Adobe Research
Jul 2, 2026·Wanyun CuiLong-Context RetrievalMemory-Augmented Language Models
Shanghai University of Finance and Economics