GPU Kernel Generation

GPU: Graphics Processing Unit

Momentum

3 papers in the last four weeks, down 25% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 45

All topics
CardsList
  1. AI as a Compiler: Compiling Triton kernels without the Triton compiler

    Sep 29, 2026François Costa, Charly Castes, Thomas Bourgeat +1GPU Kernel OptimizationLarge Language Model-Guided Optimization

  2. PTXBench: Benchmarking and Adapting LLMs for GPU Kernel Optimization with Architecture-specific PTX

    Aug 18, 2026Genghan Zhang, Yixin Dong, Chengze Fan +4LLM EvaluationGPU Kernel Optimization

  3. CAKE: Compiler-Agent Co-Design for Frontier Kernel Evolution

    Aug 12, 2026Zihao Ye, Yingyi Huang, Hongyi Jin +11GPU Kernel OptimizationGPU Kernel Generation

  4. RealisticTritonBench: A Benchmark for Triton-Kernel Generation in Real-World AI Frameworks

    Aug 12, 2026Jinjun Huang, Zhongzhen Wen, Tongtong Xu +3LLM EvaluationGPU Kernel Generation

  5. SparseDitto: An Agentic Sparse Compilation Framework through Architecture-Aware Synthesis on GPUs

    Aug 5, 2026Shiyang Li, Guangyan Sun, Jinwei Tang +3GPU Kernel OptimizationHigh-Performance Computing

  6. Don't Regenerate, Debug: A Domain-Specific Agent for Repairing Near-Miss Hardware Operators

    Aug 3, 2026Yansong Sun, Shenxiu Wu, Siyuan Chen +6Automated Program RepairGPU Kernel Generation

  7. Multi-turn RL with Structural and Performance Aware Rewards for CUDA Kernel Generation

    Jul 23, 2026Quazi Ishtiaque Mahmud, Nesreen K. Ahmed, Ali JannesariRL for Code GenerationGPU Kernel Optimization

  8. KernelGenBench: Can LLMs and Agents Write Efficient Kernels Across Operator Sources and Hardware Platforms?

    Jul 22, 2026Peiyu Zang, Jian Tao, Jialing Zhang +4GPU Kernel OptimizationBenchmark Design

  9. Nova: An End-to-End MLIR Compiler for Deep Learning

    Jul 15, 2026Adwaid Suresh, Aparna A, Harshini V M +4GPU Kernel Generation

  10. EGG: An Expert-Guided Agent Framework for Kernel Generation

    Jun 25, 2026Yaochen Han, Ke Fan, Hongxu Jiang +5GPU Kernel OptimizationLarge Language Model-Guided Optimization

  11. From Tokens to Regions: CUDA-Sensitive Instruction Tuning for GPU Kernel Generation

    Jun 15, 2026Wentao Chen, Jiace Zhu, Xing Zhe Chai +4GPU Kernel OptimizationLLM Fine-Tuning

  12. AgentCompile: An LLM-Guided Compiler for Direct CUDA Inference

    Jun 4, 2026Xuanzhe Li, Ziyan Weng, Zhiyu Zhu +1Efficient Transformer InferenceGPU Acceleration

  13. KForge: LLM-Driven Cross-Platform Kernel Generation for AI Accelerators

    Jun 1, 2026Taras Sereda, Burak Bartan, Ankita Nayak +3AI Accelerator InferenceGPU Kernel Optimization

  14. On Efficient Scaling of GNNs via IO-Aware Layers Implementations

    May 29, 2026Daria Fomina, Daniil Krasylnikov, Alexey Boykov +3Graph Attention NetworksGPU Kernel Optimization

  15. Caspar: CUDA Accelerator for Symbolic Programming with Adaptive Reordering

    May 28, 2026Emil Martens, Aaron Miller, Matias Varnum +1Bundle AdjustmentGPU Kernel Optimization

  16. HTAM: Hierarchical Transition-Attended Memory for Operator Optimization

    May 28, 2026Yining Zhang, Mingyang Yi, Chen Wang +5GPU Kernel OptimizationMemory-Augmented Language Models

  17. KLineage: Recovering the Missing When of Kernel Optimization by Deoptimizing Experts

    May 27, 2026Shuoming Zhang, Qiuchu Yu, Ruiyuan Xu +11GPU Kernel OptimizationGPU Acceleration

  18. Towards Feedback-to-Plan Decisions for Self-Evolving LLM Agents in CUDA Kernel Generation

    May 26, 2026Yee Hin Chong, Jiaming Wu, Youhui Zhang +1GPU Kernel OptimizationLLM Agent Evaluation