6 papers in the last four weeks, against 1 the four weeks before. 0.1% of all new papers.
May 5, 2026·Yixuan Mei, Zikun Li, Zixuan Chen +5LLM ServingCost-Aware Inference
Carnegie Mellon University · Peking University
May 5, 2026·Stefan Fischer, Maliheh Hariri, Sebastian OtteHeterogeneous Computing
University of Luebeck, Institute of Telematics · University of Luebeck, Institute of Robotics and Cognitive Systems
May 5, 2026·Mergen Nachin, Digant Desai, Sicheng Stephen Jia +36Heterogeneous ComputingEdge ML
Meta · Work done while at Meta.
May 2, 2026·Bin Xu, Pengfei Hu, Wenxin Zheng +2GPU AccelerationHeterogeneous Computing
Shanghai Jiao Tong University Shanghai, China
Apr 30, 2026·Ali Emre Oztas, Mahir Demir, James Garside +1AI Accelerator InferenceGPU Acceleration
The University of Manchester
Apr 23, 2026·Cooper VeitFormal VerificationHeterogeneous Computing
Ashiba Research
Apr 11, 2026·Tiancheng Hu, Jin Qin, Zheng Wang +10GPU AccelerationLLM Inference Acceleration
SCS, Peking University, Beijing, China · University of Chinese Academy of Sciences, Beijing, China · University of Leeds, West Yorkshire, England +4
Mar 17, 2026·Ruijia Yang, Zeyi WenFine-TuningMemory-Efficient Fine-Tuning
Dec 29, 2025·Gang Liao, Hongsen Qin, Ying Wang +36GPU Kernel OptimizationGPU Acceleration
KernelEvolve Team, Meta Platforms
Nov 19, 2025·Peiming Yang, Sankeerth Durvasula, Ivan Fernandez +4Compute-in-MemoryLLM Inference Acceleration
University of Toronto & Vector Institute · Barcelona Supercomputing Center · ETH Zürich +2
Sep 28, 2025·Jihu Guo, Tenghui Ma, Wei Gao +6Communication-Efficient Distributed TrainingHeterogeneous Computing
FDU & Shanghai AI Laboratory · HKUST · Independent Researcher +2
Apr 28, 2025·Alireza Furutanpey, Carmen Walser, Philipp Raith +2Efficient Neural Network InferenceHeterogeneous Computing
Coovally Barcelona, Spain · Distributed Systems Group, TU Wien, Vienna · ICREA Barcelona, Spain