Heterogeneous Computing

Latest papers 42

All topics
CardsList
  1. Rethinking Streaming-Perception Evaluation on Heterogeneous Edge Platforms

    Oct 4, 2026Misun Yu, Jinyoung Moon, Jemin LeeEdge InferenceHeterogeneous Computing

  2. HAPMoE: Heterogeneity-Aware Automatic Parallelism Planning for Mixture-of-Experts Models Training

    Sep 30, 2026Mengyuan Fan, Peizhuang Cong, Zixiao Huang +7Expert ParallelismHeterogeneous Computing

  3. Kafila: Serving Large Language Models on a Trusted Set of Heterogeneous Commodity Machines

    Sep 28, 2026Murtaza Rangwala, Richard O. Sinnott, Rajkumar BuyyaLLM InferenceLLM Inference Scheduling

  4. Rethinking Heterogeneous System Disaggregation for Subquadratic Attention

    Sep 14, 2026Arya Tschand, Yaosheng Fu, Vikram Sharma Mailthody +6Disaggregated LLM ServingLLM Inference Acceleration

  5. HiGFRL: Hierarchical Graph Fusion-Driven Reinforcement Learning for Dependency-Aware Task Scheduling in Heterogeneous Cloud

    Sep 14, 2026Tiangang Li, Shi Ying, Xiangbo TianReinforcement LearningHeterogeneous Computing

  6. Fidelity-Aware Scheduling of Quantum Circuits on Multi-QPU Systems

    Sep 9, 2026Innocenzo Fulginiti, Antonio Tudisco, Salvatore Zammuto +7High-Performance ComputingHeterogeneous Computing

  7. Para-Pipe: Exploiting Hierarchical Operator Parallelism of ML Computational Graphs on SoCs

    Sep 3, 2026Yujie Zhang, Huiying Lan, Ehsan Aghapour +5Efficient Neural Network InferenceEnergy-Efficient ML

  8. Architectural Implications of Agentic AI Workflows

    Aug 5, 2026Jirong Yang, Peizhe Liu, Chaojie Zhang +1LLM Inference SchedulingAgentic Workflows

  9. Gleam: Adaptive Network-Efficient CUDA API Remoting for Cross-Device GPU Sharing over LANs

    Jul 25, 2026Zhihao Xu, Hao Zhong, Zeting Zhou +9Heterogeneous ComputingDistributed Inference

  10. GLidE-SLAM: GL-Accelerated Indirect-Direct Embedded SLAM

    Jul 18, 2026Carlos A. Pinheiro de Sousa, Heiko Hamann, Oliver DeussenSimultaneous Localization and MappingVisual Odometry

  11. EdgeFaaS: A Function-based Framework for Edge Computing

    Jul 16, 2026Neha Vadnere, Yu-Ting Wang, Yitao Chen +2Edge ComputingInternet of Things

  12. Edge Physical AI Deployment of Vision Transformers on Heterogeneous Edge GPU Targeting Autonomous Vehicles

    Jul 12, 2026Ashiyana Abdul Majeed, Mahmoud Meribout, Neethu Joseph +2Efficient Transformer InferenceEdge Inference

  13. Optimizing ML Workload Partitioning between CPUs and CIM Accelerators for Heterogeneous Computing

    Jul 6, 2026Joel Klein, Rebecca Pelke, Roberto Laudani +2Compute-in-MemoryHeterogeneous Computing

  14. Achieving Cloud-Grade SLOs for Local Mixture-of-Experts Inference through CPU-GPU Hybrid Design

    Jun 9, 2026Wenxin Wang, Yule Hou, Yu Ji +2Expert ParallelismOn-Device Language Model Inference

  15. Terastal: Layer-Variant-based Scheduling for Real-Time Multi-DNN Workloads on Heterogeneous Accelerators

    Jun 5, 2026Sing-Yao Wu, Fengshuo Song, Eli BozorgzadehAI Accelerator InferenceReal-Time Scheduling

  16. Brief Announcement: Generative Markov Model for Distributed Computing Systems

    Jun 2, 2026Alfreds Lapkovskis, Ali Beikmohammadi, Sindri Magnússon +1Heterogeneous ComputingGenerative Modeling

  17. CodegenBench: Can LLMs Write Efficient Code Across Architectures?

    Jun 1, 2026Jie Li, Wenzhao Wu, Junqi Hu +5High-Performance ComputingCode Generation

  18. HetCCL: Enabling Collective Communication For Mixed-Vendor Heterogeneous Clusters

    May 29, 2026Yuejie Wang, Tao Chang, Yuanyuan Zhao +10Communication-Efficient Distributed TrainingHigh-Performance Computing

  19. A Methodology to Assess Power Modeling in Energy-Aware Federated Learning on Heterogeneous Mobile Devices

    May 26, 2026Chaimae Jallouli, Karim Boubouh, Robert BasmadjianEnergy-Efficient MLHeterogeneous Computing

  20. GEM: GPU-Variability-Aware Expert to GPU Mapping for MoE Systems

    May 19, 2026Sourish Wawdhane, Avinash Kumar, Poulami DasExpert Load BalancingMixture-of-Experts Inference

  21. Heterogeneous Tasks Offloading in Vehicular Edge Computing: A Federated Meta Deep Reinforcement Learning Approach

    May 18, 2026Yaorong Huang, Jingtao Luo, Xuechao WangFederated RLEdge Computing

  22. Heterogeneous SoC Integrating an Open-Source Recurrent SNN Accelerator for Neuromorphic Edge Computing on FPGA

    May 12, 2026Michelangelo Barocci, Vittorio Fra, Enrico Macii +1Edge ComputingHeterogeneous Computing

  23. An Efficient Hybrid Sparse Attention with CPU-GPU Parallelism for Long-Context Inference

    May 8, 2026Feiyu Yao, Zhixiong Niu, Xiaqing Li +3GPU AccelerationSelf-Attention

  24. HCInfer: An Efficient Inference System via Error Compensation for Resource-Constrained Devices

    May 7, 2026Shen Xu, Xiangwen Zhuge, Zhe Xu +3LLM CompressionMemory-Efficient Inference