5 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.
Sep 28, 2026·Jay H. Park, Hyungjun Kim, Dong KimKV-Cache OffloadingKV-Cache Management
Samsung Semiconductor
Sep 28, 2026·Qiuyang Zhang, Kai Zhou, Kai Lu +6KV-Cache OffloadingLong-Context Language Model Inference
Huazhong University of Science and Technology Wuhan, China · UCloud Technology Co., Ltd. Shanghai, China
Sep 27, 2026·Kunming Shao, Jierun Chen, Jiangnan Yu +7KV-Cache OffloadingKV-Cache Management
The Hong Kong University of Science and Technology · Huawei Technologies Ltd. · The University of Hong Kong +1
Sep 15, 2026·Vivek KalyanaranganKV-Cache OffloadingKV Caching
Sep 11, 2026·Joseph Kanichai, Tiziano De Matteis, Animesh TrivediKV-Cache OffloadingKV Caching
Vrije Universiteit Amsterdam Amsterdam, the Netherlands · IBM Research Zurich Zurich, Switzerland
Jul 16, 2026·Vladimir Fedosov, Aleksandr Sazhin, Artemiy Grinenko +1Fine-TuningKV-Cache Offloading
BMW Group
Jun 30, 2026·Amirhossein Abaskohi, Giuseppe Carenini, Peter West +1KV-Cache OffloadingKV Caching
University of British Columbia · Microsoft Research
Jun 29, 2026·Woernle Frank, Fedosov Vladimir, Grinenko ArtemiyKV-Cache OffloadingLong-Context Modeling
Jun 19, 2026·Omin Kwon, Doyeon Kim, Jongseok Park +3KV-Cache OffloadingDiffusion Model Serving
Seoul National University Seoul, Republic of Korea · UC Berkeley Berkeley, CA, USA
Jun 3, 2026·Yaosheng Fu, Guangxuan Xiao, Xin Dong +2KV-Cache OffloadingLong-Context Language Model Inference
1NVIDIA · 2Thinking Machines Lab · 3ByteDance Seed +1
Jun 1, 2026·Chunan Shi, Yilei Chen, Yilin Chen +2KV-Cache OffloadingLLM Inference
Peking University Beijing, China
May 18, 2026·Jian Lin, Jiazhi Mi, Zicong Hong +5KV-Cache OffloadingKV Caching
Hong Kong University of Science and Technology, China · Xi’an Jiaotong University, China
May 17, 2026·Jiayi Yao, Samuel Shen, Kuntai Du +7KV-Cache OffloadingKV Caching
University of Chicago · Tensormesh Inc. · Samsung Semiconductor +1
May 16, 2026·Yu Zhu, Aditya Dhakal, Yunming Xiao +2LLM Inference EfficiencyKV-Cache Offloading
ETH Zurich Switzerland · HPE Labs United States of America · The Chinese University of Hong Kong, Shenzhen China
May 10, 2026·Aojie Yuan, Tianqi Shen, Dajun ZhangKV-Cache OffloadingKV Caching
University of Southern California · †University of Wisconsin–Madison
Apr 29, 2026·Zihan Zhao, Baotong Lu, Shengjie Lin +8LLM ServingKV-Cache Offloading
University of Virginia · Microsoft Research · Georgia Institute of Technology +1
Apr 29, 2026·Bodon Jeong, Hongsu Byun, Youngjae Kim +4On-Device Language Model InferenceKV-Cache Offloading
1Sogang University, Seoul, Republic of Korea · 2Florida State University, FL, USA · 3Samsung Electronics Co.
Apr 24, 2026·Xin Wang, Chi Ma, Shaobin Chen +14KV-Cache OffloadingKV Caching
School of Computer Science, Wuhan University · Meituan · Nvidia
Apr 23, 2026·Hongyao Liu, Liuqun Zhai, Junyi Wang +3On-Device Language Model InferenceKV-Cache Offloading
Department of Computer Science, City University of Hong Kong, Hong Kong SAR.
Apr 19, 2026·Sanjeev Rao GanjihalKV-Cache OffloadingKV Caching
Independent Researcher
Apr 9, 2026·Andrey Bocharnikov, Ivan Ermakov, Denis Kuznedelev +2KV-Cache OffloadingKV Caching
HSE, Yandex · Yandex · Yandex, NSU
Oct 15, 2025·Yuxiang Huang, Pengjie Wang, Jicheng Han +9KV-Cache OffloadingGPU Acceleration
NLP Group, DCST, IAI, BNRIST, Tsinghua University, Beijing, China. · OpenBMB, China. · BUPT, Beijing, China. +1
Jun 24, 2024·Ruoyu Qin, Zheming Li, Weiran He +4LLM ServingDisaggregated LLM Serving
Moonshot AI · Tsinghua University