5 papers in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.
Oct 5, 2026·Zhuokun Chen, Xi Lin, Xiyu Wu +3Long-Context Language ModelingLinear Attention
Monash University · Zhejiang University
Sep 29, 2026·Bingchen Yao, Haobo Xu, Haokun Lin +6LLM QuantizationLLM Inference Acceleration
Zhejiang University · Tsinghua University · NLPR & MAIS, Institute of Automation, CAS +3
Sep 29, 2026·Yi Pan, Haocheng Xi, Kan Zhu +10LLM QuantizationLLM Inference Acceleration
UC Berkeley · University of Washington · MIT +2
Sep 26, 2026·Xinyu Zhao, Yixiang Shan, Tao Yang +5Long-Horizon Robotic ManipulationDelta-Rule Linear Attention
Simplexity Robotics
Sep 21, 2026·Julien Siems, Riccardo Grazzi, Korbinian Pöppel +8Length GeneralizationDelta-Rule Linear Attention
Sep 7, 2026·Ngoc Bui, Tinglin Huang, Rex YingMemory-Augmented Neural NetworksLinear Attention
Department of Computer Science, Yale University
Sep 3, 2026·Sergii Kozyrev, Davyd MaiborodaLLM Quantization4-Bit Quantization
Aug 31, 2026·Yanqi Yu, Pingwei Sun, Jianchao Tan +4KV CachingMemory-Efficient Inference
East China Normal University · Meituan · South China University of Technology
Aug 3, 2026·Ronglong BaoDelta-Rule Linear AttentionLanguage Model Distillation
DT-Project
Jul 8, 2026·Tommaso Cerruti, Tim Rieder, George Rowlands +2Linear AttentionDelta-Rule Linear Attention
1ETH Zurich, D-INFK · 2ETH AI Center, ETH Zurich
Jul 8, 2026·Anna Kuzina, Paul N. Whatmough, Babak Ehteshami BejnordiSoftmax AttentionLLM Inference Acceleration
Qualcomm AI Research∗ · Qualcomm AI Research
Jul 8, 2026·Loïc Cabannes, Pierre-Emmanuel Mazaré, Gergely Szilvasy +6Long-Context RetrievalMemory-Augmented Language Models
Meta FAIR · Inria Paris & ENS-PSL University · University of Tübingen
Jul 2, 2026·Wanyun CuiLong-Context RetrievalMemory-Augmented Language Models
Shanghai University of Finance and Economics
Jun 25, 2026·Sayak DuttaLinear AttentionDelta-Rule Linear Attention
Jun 25, 2026·Xiao Li, Chengruidong Zhang, Hao Luo +15Memory-Augmented Language ModelsLong-Context Language Modeling
1Qwen Team · 2Nanjing University · 3Zhejiang University
Jun 12, 2026·Tiantian ZhangEfficient AttentionLinear Attention
Columbia University
Jun 7, 2026·Sumin Park, Seojin Kim, Noseong ParkLinear AttentionDelta-Rule Linear Attention
Korea Advanced Institute of Science and Technology (KAIST), Daejeon, Republic of Korea.
May 21, 2026·Ali Hatamizadeh, Yejin Choi, Jan KautzLong-Context Language ModelingRecurrent Transformers
NVIDIA
May 20, 2026·Aleksandros Sobczyk, Gioele Gottardo, Christos K. Matzoros +4Efficient Transformer InferenceAI Accelerator Inference
Computing Systems Lab Huawei Technologies2026 Switzerland
May 13, 2026·Chenyu Zhou, Hongpei Li, Yuerou Liu +3Transformer AttentionLinear Attention
Shanghai Jiao Tong University · Northwestern University · Huazhong University of Science and Technology +1
May 9, 2026·Jiaxuan Zou, Ruifeng Ren, Yong LiuLong-Context Language ModelingRecurrent Transformers
School of Mathematics and Statistics Xi’an Jiaotong University Xi’an, China · Gaoling School of Artificial Intelligence Renmin University of China Beijing, China
May 7, 2026·Yulong Huang, Xiang Liu, Hongxiang Huang +5Momentum MethodsLinear Attention
The Hong Kong University of Science and Technology (Guangzhou), Guangzhou, China
Apr 22, 2026·Neehal Tumma, Noel Loo, Daniela RusLong-Context Language ModelingRecurrent Neural Networks
1MIT · 2Liquid AI
Apr 21, 2026·Pingwei Sun, Yuxuan Hu, Jianchao Tan +6Long-Context ModelingLinear Attention
Meituan · Beijing, China
Dec 14, 2025·Jingdi Lei, Di Zhang, Soujanya PoriaDynamical SystemsLinear Attention
Nanyang Technological University · Fudan University