GPU Kernel Generation

GPU: Graphics Processing Unit

Momentum

3 papers in the last four weeks, down 25% on the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 45

All topics
CardsList
  1. AI as a Compiler: Compiling Triton kernels without the Triton compiler

    Sep 29, 2026François Costa, Charly Castes, Thomas Bourgeat +1GPU Kernel OptimizationLarge Language Model-Guided Optimization

  2. PTXBench: Benchmarking and Adapting LLMs for GPU Kernel Optimization with Architecture-specific PTX

    Aug 18, 2026Genghan Zhang, Yixin Dong, Chengze Fan +4LLM EvaluationGPU Kernel Optimization

  3. CAKE: Compiler-Agent Co-Design for Frontier Kernel Evolution

    Aug 12, 2026Zihao Ye, Yingyi Huang, Hongyi Jin +11GPU Kernel OptimizationGPU Kernel Generation

  4. RealisticTritonBench: A Benchmark for Triton-Kernel Generation in Real-World AI Frameworks

    Aug 12, 2026Jinjun Huang, Zhongzhen Wen, Tongtong Xu +3LLM EvaluationGPU Kernel Generation

  5. SparseDitto: An Agentic Sparse Compilation Framework through Architecture-Aware Synthesis on GPUs

    Aug 5, 2026Shiyang Li, Guangyan Sun, Jinwei Tang +3GPU Kernel OptimizationHigh-Performance Computing

  6. Don't Regenerate, Debug: A Domain-Specific Agent for Repairing Near-Miss Hardware Operators

    Aug 3, 2026Yansong Sun, Shenxiu Wu, Siyuan Chen +6Automated Program RepairGPU Kernel Generation

  7. Multi-turn RL with Structural and Performance Aware Rewards for CUDA Kernel Generation

    Jul 23, 2026Quazi Ishtiaque Mahmud, Nesreen K. Ahmed, Ali JannesariRL for Code GenerationGPU Kernel Optimization

  8. KernelGenBench: Can LLMs and Agents Write Efficient Kernels Across Operator Sources and Hardware Platforms?

    Jul 22, 2026Peiyu Zang, Jian Tao, Jialing Zhang +4GPU Kernel OptimizationBenchmark Design

  9. Nova: An End-to-End MLIR Compiler for Deep Learning

    Jul 15, 2026Adwaid Suresh, Aparna A, Harshini V M +4GPU Kernel Generation

  10. EGG: An Expert-Guided Agent Framework for Kernel Generation

    Jun 25, 2026Yaochen Han, Ke Fan, Hongxu Jiang +5GPU Kernel OptimizationLarge Language Model-Guided Optimization

  11. From Tokens to Regions: CUDA-Sensitive Instruction Tuning for GPU Kernel Generation

    Jun 15, 2026Wentao Chen, Jiace Zhu, Xing Zhe Chai +4GPU Kernel OptimizationLLM Fine-Tuning

  12. AgentCompile: An LLM-Guided Compiler for Direct CUDA Inference

    Jun 4, 2026Xuanzhe Li, Ziyan Weng, Zhiyu Zhu +1Efficient Transformer InferenceGPU Acceleration

  13. KForge: LLM-Driven Cross-Platform Kernel Generation for AI Accelerators

    Jun 1, 2026Taras Sereda, Burak Bartan, Ankita Nayak +3AI Accelerator InferenceGPU Kernel Optimization

  14. On Efficient Scaling of GNNs via IO-Aware Layers Implementations

    May 29, 2026Daria Fomina, Daniil Krasylnikov, Alexey Boykov +3Graph Attention NetworksGPU Kernel Optimization

  15. Caspar: CUDA Accelerator for Symbolic Programming with Adaptive Reordering

    May 28, 2026Emil Martens, Aaron Miller, Matias Varnum +1Bundle AdjustmentGPU Kernel Optimization

  16. HTAM: Hierarchical Transition-Attended Memory for Operator Optimization

    May 28, 2026Yining Zhang, Mingyang Yi, Chen Wang +5GPU Kernel OptimizationMemory-Augmented Language Models

  17. KLineage: Recovering the Missing When of Kernel Optimization by Deoptimizing Experts

    May 27, 2026Shuoming Zhang, Qiuchu Yu, Ruiyuan Xu +11GPU Kernel OptimizationGPU Acceleration

  18. Towards Feedback-to-Plan Decisions for Self-Evolving LLM Agents in CUDA Kernel Generation

    May 26, 2026Yee Hin Chong, Jiaming Wu, Youhui Zhang +1GPU Kernel OptimizationLLM Agent Evaluation

  19. FastKernels: Benchmarking GPU Kernel Generation in Production

    May 22, 2026Gabriele Oliaro, Yichao Fu, May Jiang +5GPU Kernel OptimizationGPU Acceleration

  20. Prior Knowledge or Search? A Study of LLM Agents in Hardware-Aware Code Optimization

    May 19, 2026Dmitry Redko, Albert Fazlyev, Konstantin Sozykin +3GPU Kernel OptimizationLarge Language Model-Guided Optimization

  21. CODA: Rewriting Transformer Blocks as GEMM-Epilogue Programs

    May 19, 2026Han Guo, Jack Zhang, Arjun Menon +4GPU Kernel OptimizationGPU Acceleration

  22. CUDAHercules: Benchmarking Hardware-Aware Expert-level CUDA Optimization for LLMs

    May 8, 2026Shiyang Li, Zijian Zhang, Guangyan Sun +5LLM EvaluationGPU Kernel Optimization

  23. Kernel Foundry: A Diagnosis-driven Evolutionary Kernel Optimizer with Multi-Experts

    May 8, 2026Zixuan Huang, Da Chen, Kecheng Huang +5GPU Kernel OptimizationGPU Acceleration

  24. CuBridge: An LLM-Based Framework for Understanding and Reconstructing High-Performance Attention Kernels

    May 6, 2026Xing Ma, Yangjie Zhou, Wu Sun +6GPU Kernel OptimizationGPU Acceleration

  25. AdaExplore: Failure-Driven Adaptation and Diversity-Preserving Search for Efficient Kernel Generation

    Apr 17, 2026Weihua Du, Jingming Zhuo, Yixin Dong +9Test-Time AdaptationGPU Kernel Optimization

  26. ARGUS: Agentic GPU Optimization Guided by Data-Flow Invariants

    Apr 16, 2026Haohui Mai, Xiaoyan Guo, Xiangyun Ding +7GPU Kernel OptimizationGPU Acceleration

  27. Nautilus: An Auto-Scheduling Tensor Compiler for Efficient Tiled GPU Kernels

    Apr 16, 2026Yifan Zhao, Yuchen Yang, Matei Budiu +1GPU Kernel OptimizationGPU Acceleration

  28. KernelFoundry: Hardware-aware evolutionary GPU kernel optimization

    Mar 12, 2026Nina Wiedemann, Quentin Leboutet, Michael Paulitsch +2GPU Kernel OptimizationGPU Acceleration

  29. KernelEvolve: Scaling Agentic Kernel Coding for Heterogeneous AI Accelerators at Meta

    Dec 29, 2025Gang Liao, Hongsen Qin, Ying Wang +36GPU Kernel OptimizationGPU Acceleration