AI Accelerator Inference

Latest papers 68

All topics
CardsList
  1. Efficient Mixture-of-Experts LLM Inference with Apple Silicon NPUs

    Apr 20, 2026Afsara Benazir, Felix Xiaozhu LinAI Accelerator InferenceEnergy-Efficient ML

  2. DEEP-GAP: Deep-learning Evaluation of Execution Parallelism in GPU Architectural Performance

    Apr 16, 2026Kathiravan PalaniappanAI Accelerator InferenceGPU Acceleration

  3. Intelligence per Watt: Measuring Intelligence Efficiency of Local AI

    Nov 11, 2025Jon Saad-Falcon, Avanika Narayan, Hakki Orhun Akengin +12LLM Inference EfficiencyAI Accelerator Inference

  4. Systematic Exploration of Multi-core Architectures for Efficient LLM Serving using WaferAI-SIM

    Oct 7, 2025Tianhao Zhu, Dahu Feng, Erhu Feng +1AI Accelerator InferenceLLM Serving

  5. PVF:Understanding AI Vulnerability Against SDCs

    May 2, 2024Xun Jiao, Fred Lin, Harish D. Dixit +8AI Accelerator Inference