LLM Code Generation

LLM: Large Language Model

Momentum

17 papers in the last four weeks, up 42% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 196

All topics
CardsList
  1. LLM-Assisted Generation of Transparent, Open-Source Multiphysics Models of Electrochemical Devices

    Oct 7, 2026Sebastian Castro, Maya F. Schuchert, Spencer A. McCluskey +2LLM Code GenerationPhysics-Based Simulation

  2. VHDL-REPOBENCH: A Repository-Level Benchmark for Evaluating Large Language Models on VHDL Design Generation

    Oct 4, 2026Prashanth Vijayaraghavan, Akul Malhotra, Ashutosh Jadhav +2LLM EvaluationCode Generation

  3. Grammar-Guided Code Watermarking with Green Temperature

    Oct 4, 2026Hyundong Jin, Hyeseon An, Soohan Lim +1Text WatermarkingLLM Watermarking

  4. Hidden in the Comments: A Context-Injection Attack Surface in Code LLMs

    Oct 4, 2026Noor Munir, Francesco Quinzan, Stephen RobertsLLM SecurityIndirect Prompt Injection

  5. Where LLMs Fail with Visualization DSLs

    Oct 1, 2026Chang Han, Andrew McNutt, Katherine IsaacsData VisualizationLLM Evaluation

  6. ReMCTS: Reflection-Enhanced Monte Carlo Tree Search for Code Generation

    Sep 28, 2026Huifei Wang, Xinying Huang, Yiheng Sun +1Execution-Guided Code GenerationLLM-Based Program Synthesis

  7. Improving Large Language Models for Code through Runtime Program-State Reasoning

    Sep 28, 2026Hongwei Li, Spandan Garg, Yufan HuangAutomated Program RepairAutomated Test Generation

  8. How code helps different tasks? A decompositional lens on LLM post-training

    Sep 27, 2026Zheng Yu, Yiwei Li, Yishen Chen +4LLM Fine-TuningInstruction-Tuning Data Selection

  9. Large Language Models for Programming: Actually Fixing or Reimplementing Incorrect Code?

    Sep 24, 2026Alexandru Stefan Stoica, Traian Rebedea, Marian Cristian MihaescuLLM EvaluationAutomated Program Repair

  10. FLEET: From Logits Entropy to Enhanced Trajectories in Text Generation

    Sep 23, 2026Oleksii Streltsov, Oleksandra VitkoLanguage Model DecodingMemory-Augmented Language Models

  11. Performance, Efficiency and Collapse -- Advantages and Challenges in Offline Post-training of Code LLMs

    Sep 14, 2026Abhinav Anand, Sanjana Reddy Pachika, Shweta Verma +1RL for Code GenerationOffline RL

  12. GraphAHA: Graph-Based Adaptive Search with Heterogeneous Actions for Test-Time Code Generation

    Sep 14, 2026Xitao Li, Haijun Wang, Gege Yuan +4Inference-Time SearchTest-Time Scaling

  13. Towards a Deterministic Math Solver for Clinical Language Models

    Sep 12, 2026Felipe Ocampo Osorio, Sebastián Andrés Cajas Ordoñez, Maximin Lange +5Numerical Reasoning in Language ModelsLLM Reliability

  14. Talking to Itself While Coding: What Makes Comments Help Code Generation?

    Sep 10, 2026Dangfeng Pan, Zhensu Sun, Cenyuan Zhang +2LLM PromptingCode Generation

  15. Retrofitting Code Using LLMs to Support Exceptional Behavior

    Sep 9, 2026Linghan Zhong, Jiyang Zhang, Jayanth Srinivasa +2Code GenerationCode Generation Benchmarks

  16. ΦΦ-Bench: Can Large Language Models Engineer the Infrastructure That Powers Them?

    Sep 9, 2026Leilei Ding, Shumin Wang, Yuting Huang +10LLM EvaluationLarge Language Model-Guided Optimization

  17. Two-Stage Reinforcement Learning for Sound and Adversarial Test Generation in Code LLMs

    Sep 3, 2026Jiacheng Xu, Wentao Zhang, Zhiyi Lyu +4Automated Test GenerationLLM Code Generation

  18. Automated Vulnerability Injection in Smart Contracts Using Large Language Models

    Sep 2, 2026Luca Migliaccio, Roberto Natella, Naghmeh Ivaki +2Software SecuritySoftware Vulnerability Detection

  19. Can LLMs Design Video Coding Tools? A Case Study on Planar Mode

    Sep 1, 2026Yingwen Zhang, Meng Wang, Liqiang He +1Video CompressionLLM Code Generation

  20. LLM Post-Training as Brownfield Maintenance: An Industrial Perspective on Dataware Engineering

    Aug 31, 2026Gopi Krishnan Rajbahadur, Amir M. Ebrahimi, Boyuan Chen +1Training Data CurationLLM Post-Training

  21. CARVE: Verified Expansion for Variable-Length Generation in Diffusion Language Models

    Aug 31, 2026Wail Bouhedja, Amr Mohamed, Guokan ShangMasked Diffusion ModelsLLM Inference Acceleration

  22. LLM-based Hardware Development with Hierarchical IRs and End-to-End Multi-Agent Workflow

    Aug 31, 2026Chenyang Yin, Agasthi Haputhanthri, Aditya Anirudh Jonnalagadda +7Electronic Design AutomationLLM-Based Program Synthesis

  23. Interpreting and Steering for Safe and Correct Code Generation

    Aug 30, 2026Hao Yan, Ziyu YaoMechanistic InterpretabilityLLM Security

  24. GVS5H: Zero-Shot Self-Orchestration with Ledger-Based Control for Improved LLM Coding Performance

    Aug 27, 2026Victor Gao, Vida Khosrowshahi, Ali Khosrowshahi +4Zero-Shot LearningMulti-Agent LLM Systems

  25. From Visual Widgets to UI Code: Efficient Tool-Grounded Generation

    Aug 12, 2026Houston H. Zhang, Tao Zhang, Li Gu +5Code GenerationLLM Code Generation

  26. Do Influence Tactics Matter? Investigating Prompt Framing Effects in LLM Code Generation

    Aug 11, 2026Alex Deaconu, Anubhav Gupta, Manaal Basha +2LLM PromptingFraming Effects in Language Models

  27. CHORUS: Complementary Experts for High-Coverage Testbench Stimulus Generation

    Aug 10, 2026Hejia Zhang, Sheng Lu, Zhongming Yu +3RL for Code GenerationAutomated Test Generation

  28. LangChoiceBench: Measuring and Explaining Programming-Language Choice in LLMs

    Aug 6, 2026Lukas Twist, Twm Stone, Helen Yannakoudakis +1LLM EvaluationLanguage Model Bias Evaluation

  29. Large language models for partial differential equation workflows

    Aug 4, 2026Han Wan, Rui Zhang, Hao SunPDE DiscoveryLarge Language Model-Guided Optimization

  30. Distilling Reasoning Traces into Advisory Prompts for Software Engineering Tasks

    Aug 1, 2026Faizan Faisal, Prem Devanbu, Toufique AhmedReasoning DistillationLLM Prompting

  31. Simulation Code Generation for Fluid Systems using Large Language Models: Benchmarking Models and Prompting Strategies

    Jul 31, 2026Jan Marius Stürmer, Jascha Knack, Tobias Koch +1LLM PromptingCode Generation Evaluation

  32. RTLCurator: Label-Efficient Data Curation for RTL Generation

    Jul 31, 2026Siyang Cai, Cangyuan Li, Wenjing Chang +4Training Data CurationTraining Data Selection

  33. Metaphor-Induced Algorithmic Steering: Cross-Domain Procedural Transfer in LLM Code Generation

    Jul 30, 2026Zhibo Hu, Chen Wang, Yanfeng Shu +3Language Model SteeringCode Generation

  34. SecDrift: Measuring Sector-Conditioned Security Drift in AI-Generated Code

    Jul 28, 2026Narayanaswami Natraj Bharadwaj, Dhivya ChandramouleeswaranCybersecurityLLM Security

  35. Efficient LLM-Generated Shuttling Compilers for Complex Trapped-Ion Architectures

    Jul 27, 2026Fabian Kreppel, Reza Salkhordeh, Ferdinand Schmidt-Kaler +1Quantum Circuit CompilationLLM-Based Program Synthesis

  36. Benchmarking LLMs for Verilog Design Flows

    Jul 23, 2026Angshuman Chakravertty, Rahul Koshti, Buddhi Prakash Sharma +1Code GenerationCode Generation Evaluation

  37. Agentic coding without the cloud: evaluating open-weight large language models on longitudinal data preparation tasks

    Jul 23, 2026Mack Nixon, Liam Wright, Yevgeniya Kovalchuk +4AI Agent BenchmarksOpen-Weight Language Models

  38. An LLM-Driven Workflow for Automated Process Control Strategy Generation and Tuning from Dynamic Process Models

    Jul 23, 2026Ari Luna Rueda, Eike Cramer, Klaus Hellgardt +1Language Model-Based ControlFeedback Control

  39. Tool-Guided Retrieval-Augmented Repair for Securing LLM-Generated C Code

    Jul 21, 2026Vidyut Sriram, Saatvik Pradhan, Suman SahaAutomated Program RepairCode Generation

  40. Decode-Time Grammars: Constrained LLM Generation over a Refinement Order of Grammar Fragments

    Jul 20, 2026Shuoming Zhang, Ruiyuan Xu, Haofeng Li +7Code GenerationLLM Code Generation

  41. CommitLLM: A Fine-Tuned Pipeline for Git Commit Message Generation

    Jul 20, 2026Md Rafid Haque, Poojan Narendrabhai Patel, Meetkumar Vijaybhai RaychuraLLM Code GenerationText Generation

  42. Large Language Models for Code Generation from Multilingual Prompts: A Curated Benchmark and a Study on Code Quality

    Jul 16, 2026Saima Afrin, Alessandro Midolo, Camilo Escobar-Velásquez +5Multilingual Language Model EvaluationCode Generation

  43. How to Guide LLM Generation: Dual-Surrogate Guided Search for Automated Heuristic Design

    Jul 15, 2026Yuhan Wang, Chaoda Peng, Xingyu Wu +2Surrogate-Assisted OptimizationAutomated Heuristic Design

  44. Quantize with Confidence? An Empirical Study of Quantization for Code Generation

    Jul 15, 2026Saima Afrin, Md. Zahidul Haque, Antonio MastropaoloLLM QuantizationCode Generation Evaluation

  45. Line-Anchored Feedback Cuts Token Costs and Improves Correctness in AI Code Editing

    Jul 14, 2026William Franz LambertiCode Generation EvaluationCode Language Models

  46. Knowledge-Conditioned, Single-Pass LLM Synthesis of Executable Unity Game Scenes: A Compiler Error Census across 26 Goal Playable Concepts

    Jul 11, 2026Hugh Xuechen Liu, Kıvanç TatarLLM-Based Program SynthesisProcedural Content Generation

  47. Specification Grounding Drives Test Effectiveness for LLM Code

    Jul 7, 2026Amin Haeri, Mahdi GhelichiLLM GroundingAutomated Software Testing

  48. Benchmarking API Drift in LLM-Generated Quantum Code Across Successive SDK Versions

    Jul 5, 2026Mohammad Arif Rasyidi, Syahirul FaizCode Generation BenchmarksLLM Code Generation