LLM Code Generation

LLM: Large Language Model

Momentum

17 papers in the last four weeks, up 42% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 196

All topics
CardsList
  1. PRISM: A Benchmark for Programmatic Spatial-Temporal Reasoning

    May 19, 2026Qiran Zhang, Yuheng Wang, Runde Yang +9Spatial ReasoningCode Generation Benchmarks

  2. AI4BayesCode: From Natural Language Descriptions to Validated Modular Stateful Bayesian Samplers

    May 18, 2026Jungang Zou, Alex Ziyu Jiang, Qixuan ChenMarkov Chain Monte CarloBayesian Inference

  3. AutoVecCoder: Teaching LLMs to Generate Explicitly Vectorized Code

    May 18, 2026Shangzhan Li, Xinyu Yin, Xuanyu Jin +8Large Language Model-Guided OptimizationCode Generation

  4. Task Abstention for Large Language Models in Code Generation

    May 16, 2026Yanke Zhou, Yuhao Tan, Senrong Xu +4Selective PredictionLLM Hallucination Mitigation

  5. Syntax Without Semantics: Teaching Large Language Models to Code in an Unseen Language

    May 15, 2026Vinayshekhar Bannihatti Kumar, Disha Makhija, Manoj Ghuhan Arivazhagan +1LLM Fine-TuningCode Language Models

  6. FrontierSmith: Synthesizing Open-Ended Coding Problems at Scale

    May 14, 2026Runyuan He, Qiuyang Mang, Shang Zhou +14Synthetic Benchmark GenerationSynthetic Data Generation for Language Models

  7. Hydra: Efficient, Correct Code Generation via Checkpoint-and-Rollback Support

    May 14, 2026Alexander Du, Jianjun Ou, Danyang Zhuo +1Automated Program RepairCode Generation

  8. The Readability Spectrum: Patterns, Issues, and Prompt Effects in LLM-Generated Code

    May 13, 2026Hengzhi Ye, Fengyuan Ran, Weiwei Xu +1LLM PromptingCode Generation Evaluation

  9. Uncertainty Quantification for LLM-based Code Generation

    May 12, 2026Senrong Xu, Yuhao Tan, Yanke Zhou +6Uncertainty QuantificationLLM Uncertainty Estimation

  10. LLMs for Secure Hardware Design and Related Problems: Opportunities and Challenges

    May 11, 2026Johann Knechtel, Ozgur Sinanoglu, Ramesh KarriElectronic Design AutomationCybersecurity

  11. CodeClinic: Evaluating Automation of Coding Skills for Clinical Reasoning Agents

    May 10, 2026Timothy Ossowski, Xinchi Liu, Danyal Maqbool +6HealthcareLLM Agent Skill Learning

  12. SmartEval: A Benchmark for Evaluating LLM-Generated Smart Contracts from Natural Language Specifications

    May 10, 2026Abhinav Goel, Agostino Capponi, Alfio Gliozzo +1Code GenerationCode Generation Evaluation

  13. PrepBench: How Far Are We from Natural-Language-Driven Data Preparation?

    May 9, 2026Jingzhe Xu, Rui Wang, Jiannan Wang +1LLM EvaluationLLM Code Generation

  14. Mage: Multi-Axis Evaluation of LLM-Generated Executable Game Scenes Beyond Compile-Pass Rate

    May 8, 2026Hugh Xuechen Liu, Kıvanç TatarCode GenerationCode Generation Evaluation

  15. PaT: Planning-after-Trial for Efficient Test-Time Code Generation

    May 8, 2026Youngsik Yoon, Sungjae Lee, Seockbean Song +3Test-Time OptimizationExecution-Guided Code Generation

  16. Correct Code, Vulnerable Dependencies: A Large Scale Measurement Study of LLM-Specified Library Versions

    May 7, 2026Chengjie Wang, Jingzheng Wu, Xiang Ling +2Software EngineeringLLM Security

  17. Delta-Based Neural Architecture Search: LLM Fine-Tuning via Code Diffs

    May 6, 2026Santosh Premi Adhikari, Radu Timofte, Dmitry IgnatovLarge Language Model-Guided NASLLM Fine-Tuning

  18. Bridging Generation and Training: A Systematic Review of Quality Issues in LLMs for Code

    May 6, 2026Kaifeng He, Xiaojun Zhang, Peiliang Cai +7Training Data CurationCode Generation Evaluation

  19. Measuring and Mitigating Bias in Code Generated by Large Language Models

    May 5, 2026Yuxi Chen, Yutian Tang, Timothy StorerAlgorithmic BiasLanguage Model Bias Evaluation

  20. AI-Generated Smells: An Analysis of Code and Architecture in LLM and Agent-Driven Development

    May 4, 2026Yuecai Zhu, Nikolaos Tsantalis, Peter C. RigbySoftware EngineeringLLM Auditing

  21. LLM-Assisted Repository-Level Generation with Structured Spec-Driven Engineering

    May 4, 2026Shuzhao Feng, Boqi Chen, Brett H Meyer +1Code GenerationRepository-Level Code Generation

  22. Improving LLM Code Generation via Requirement-Aware Curriculum Reinforcement Learning

    May 1, 2026Shouyu Yin, Zhao Tian, Junjie Chen +1RL for Code GenerationCurriculum Learning

  23. ScaleBox: Enabling High-Fidelity and Scalable Code Verification for Large Language Models

    Apr 30, 2026Jiasheng Zheng, Xin Zheng, Boxi Cao +8LLM Code Generation

  24. To Diff or Not to Diff? Structure-Aware and Adaptive Output Formats for Efficient LLM-based Code Editing

    Apr 30, 2026Wei Cheng, Yongchang Cao, Chen Shen +4Code GenerationLLM Inference Acceleration