GPU Acceleration

GPU: Graphics Processing Unit

Latest papers 125

All topics
CardsList
  1. PySIFT: GPU-Resident Deterministic SIFT for Deep Learning Vision Pipelines

    May 18, 2026Sivakumar K. S., Mohammad Daniyalur Rahman, Gopi Raju MattaGPU AccelerationImage Matching

  2. DualKV: Shared-Prompt Flash Attention for Efficient RL Training with Large Rollouts and Long Contexts

    May 14, 2026Jiading Gai, Shuai Zhang, Xiang Song +2GPU AccelerationSelf-Attention

  3. Parallelizing Counterfactual Regret Minimization

    May 14, 2026Juho Kim, Tuomas SandholmGPU AccelerationImperfect-Information Games

  4. EnergyLens: Predictive Energy-Aware Exploration for Multi-GPU LLM Inference Optimization

    May 14, 2026Zhiye Song, Kyungmi Lee, Eun Kyung Lee +3LLM Inference EfficiencyEnergy-Efficient ML

  5. BlitzGS: City-Scale Gaussian Splatting at Lightning Speed

    May 13, 2026Zhongtao Wang, Huishan Au, Yilong Li +63D Gaussian Splatting3D Gaussian Pruning

  6. The Illusion of Power Capping in LLM Decode: A Phase-Aware Energy Characterisation Across Attention Architectures

    May 12, 2026Bole Ma, Ayesha Afzal, Jan Eitzinger +1LLM Inference EfficiencyLanguage Model Decoding

  7. Fast MoE Inference via Predictive Prefetching and Expert Replication

    May 12, 2026Ankit Jyothish, Ali Jannesari, Aishwarya Sarkar +1Expert Load BalancingGPU Acceleration

  8. ChunkFlow: Communication-Aware Chunked Prefetching for Layerwise Offloading in Distributed Diffusion Transformer Inference

    May 11, 2026Han Meng, Danny Willow Liu, Dong LiDiffusion TransformerGPU Acceleration

  9. Novel GPU Boruta algorithms for feature selection from high-dimensional data

    May 11, 2026Xurui Li, Zhiguo Gan, Jiaming Zhang +2GPU AccelerationFeature Selection

  10. SceneFactory: GPU-Accelerated Multi-Agent Driving Simulation with Physics-Based Vehicle Dynamics

    May 8, 2026Yicheng Zhu, Yang Chen, Tao Li +1GPU AccelerationVehicle Dynamics

  11. CUDAHercules: Benchmarking Hardware-Aware Expert-level CUDA Optimization for LLMs

    May 8, 2026Shiyang Li, Zijian Zhang, Guangyan Sun +5LLM EvaluationGPU Kernel Optimization

  12. An Efficient Hybrid Sparse Attention with CPU-GPU Parallelism for Long-Context Inference

    May 8, 2026Feiyu Yao, Zhixiong Niu, Xiaqing Li +3GPU AccelerationSelf-Attention

  13. Kernel Foundry: A Diagnosis-driven Evolutionary Kernel Optimizer with Multi-Experts

    May 8, 2026Zixuan Huang, Da Chen, Kecheng Huang +5GPU Kernel OptimizationGPU Acceleration

  14. GPU-Accelerated Synthesis of Mixed-Boolean Arithmetic: Beyond Caching

    May 7, 2026Gabriel Bathie, Baptiste Mouillon, Nathanaël FijalkowGPU AccelerationProgram Synthesis

  15. CuBridge: An LLM-Based Framework for Understanding and Reconstructing High-Performance Attention Kernels

    May 6, 2026Xing Ma, Yangjie Zhou, Wu Sun +6GPU Kernel OptimizationGPU Acceleration

  16. One Pool, Two Caches: Adaptive HBM Partitioning for Accelerating Generative Recommender Serving

    May 6, 2026Wenjun Yu, Shuguang Han, Amelie Chi ZhouLLM Inference EfficiencyGPU Acceleration

  17. Tile-Level Activation Overlap for Efficient LLM Inference

    May 5, 2026Abhinav Jangda, Tyler Sorensen, Sebastian Burckhardt +3LLM Inference EfficiencyGPU Kernel Optimization

  18. Stochastic Sparse Attention for Memory-Bound Inference

    May 3, 2026Kyle Lee, Corentin Delacour, Kevin Callahan-Coray +5GPU AccelerationSelf-Attention

  19. VUDA: Breaking CUDA-Vulkan Isolation for Spatial Sharing of Compute and Graphics on the Same GPU

    May 2, 2026Bin Xu, Pengfei Hu, Wenxin Zheng +2GPU AccelerationHeterogeneous Computing

  20. SURGE: SuperBatch Unified Resource-efficient GPU Encoding for Heterogeneous Partitioned Data

    May 1, 2026Shashank Kapadia, Deep Narayan Mishra, Sujal Reddy Alugubelli +3Efficient Neural Network InferenceGPU Acceleration

  21. VkSplat: High-Performance 3DGS Training in Vulkan Compute

    Apr 30, 2026Jingxiang Chen, Mohamed Ibrahim, Yang Liu3D Gaussian Splatting3DGS Acceleration

  22. DPU or GPU for Accelerating Neural Networks Inference -- Why not both? Split CNN Inference

    Apr 30, 2026Ali Emre Oztas, Mahir Demir, James Garside +1AI Accelerator InferenceGPU Acceleration

  23. Real-Time GPU-Accelerated Monte Carlo Evaluation of Safety-Critical AEB Systems Under Uncertainty

    Apr 29, 2026Akshay Karjol, Shadi AlawnehCollision AvoidanceUncertainty Quantification

  24. Efficient Training on Multiple Consumer GPUs with RoundPipe

    Apr 29, 2026Yibin Luo, Shiwei Gao, Huichuan Zheng +2GPU AccelerationLLM Fine-Tuning

  25. FloatSOM: GPU-Accelerated, Distributed, Topology-Flexible Self-Organizing Maps

    Apr 29, 2026Tony Xu, Sarah Klamt, Katherine Turner +3GPU AccelerationHigh-Performance Computing