Code Generation

Momentum

30 papers in the last four weeks, up 131% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 300

All topics
CardsList
  1. Grammar-Guided Code Watermarking with Green Temperature

    Oct 4, 2026Hyundong Jin, Hyeseon An, Soohan Lim +1Code GenerationContext-Free Grammars

  2. Code That Works, Environments That Don't: Measuring Environment Reproducibility in AI-Generated Software

    Sep 30, 2026Bhanu Prakash Vangala, Tanu MalikCoding AgentsCode Generation

  3. Self-Spec Verifiable Code Generation

    Sep 30, 2026Jiaru Qian, Yihong Dong, Yongmin Li +3Code GenerationFormal Verification

  4. EngramBench: A Capability-Grounded Benchmark for Skill-Evolution Harnesses

    Sep 30, 2026Zhixuan Tan, Pengjie Gu, Zhao Li +4Coding AgentsAgentic Benchmarks

  5. Mixture of Self-Improving Branches For Agent Harness Optimization

    Sep 29, 2026Haoyu Dong, Yuhang Zhou, Zihao Lin +6Evolving HarnessRecursive Self-Improvement

  6. JevVibe: Efficient Classification-Guided Secure Code Generation

    Sep 28, 2026Arshak Rezvani, Sasha Behrouzi, Ahmad-Reza SadeghiCode GenerationRepair

  7. ReMCTS: Reflection-Enhanced Monte Carlo Tree Search for Code Generation

    Sep 28, 2026Huifei Wang, Xinying Huang, Yiheng Sun +1Monte Carlo Tree SearchCode Generation

  8. ZeroCode: On-demand Error-Correcting Code Construction from the Zero Matrix via Reinforcement Learning

    Sep 28, 2026Ju-Hyeong Lee, Yongjune Kim, Sang-Hyo Kim +2Source-Channel CodingQuantum Error Correction

  9. Rethinking Token Reweighting for SFT: Suppress, Reverse, and Extrapolate Learned Features

    Sep 27, 2026Cunchun Li, Haonan He, Yifan Gao +4Supervised FinetuningReweighting

  10. SciWalker: Synthesizing Scientific Coding Problems with Operator Graphs and Execution Feedback

    Sep 24, 2026Chenxi Li, Wenxuan Zeng, Yun Luo +4Code GenerationLarge Language Model Workflows

  11. SWE-Proof: Can Language Models Resolve Real-World Issues with Machine-Checked Proofs?

    Sep 18, 2026George Ma, Benjamin Mikek, Haoyu Li +9Swe-Bench VerifiedFormal Verification

  12. LLM-as-an-Improver: Turning Verification into Better Candidates

    Sep 17, 2026Akiyoshi Tomihari, Yuma IchikawaCode GenerationReasoning Benchmark

  13. A Study of the Reliability of Agentic AI-Generated Programs

    Sep 16, 2026Ayesha Shafique, Barton P. MIller, Elisa R. HeymannTest GenerationCode Generation

  14. Auto-HSI: Personalized human control of a robot swarm on demand by using LLMs for online automatic code generation

    Sep 14, 2026Alessandro Nazzari, Nathan Cerisara, Dorian Tonnis +5Robotic SystemsSwarms

  15. CodeTS: Verifiable Text-to-Time Series Generation via Executable Code

    Sep 14, 2026Xudong Yuan, Shunyu Liu, Tongya Zheng +3Time-Series GenerationText Generation

  16. GTA: Graph Theory Agent and Benchmark for Algorithmic Graph Reasoning with LLMs

    Sep 14, 2026Zixiang Xu, Yanbo Wang, Chenxi Wang +6Graph RepresentationsLarge Language Model Benchmarks

  17. GraphAHA: Graph-Based Adaptive Search with Heterogeneous Actions for Test-Time Code Generation

    Sep 14, 2026Xitao Li, Haijun Wang, Gege Yuan +4Code GenerationRepair

  18. What is the Difference Between Me and You? Benchmarking the Quality Gap Between Human-Written and AI-Generated Code

    Sep 14, 2026Cristina Improta, Pietro Liguori, Domenico CotroneoCode QualityCode Generation

  19. The Vibe Shift in Software Engineering: Evaluating AI-Led Conversational Programming for Performance, Cognition, and Responsible Adoption

    Sep 10, 2026Sales G. Aribe Jr., Louie Jay S. LabastidaVibe CodingSoftware Engineering

  20. Talking to Itself While Coding: What Makes Comments Help Code Generation?

    Sep 10, 2026Dangfeng Pan, Zhensu Sun, Cenyuan Zhang +2Code GenerationLarge Language Model Generation

  21. Retrofitting Code Using LLMs to Support Exceptional Behavior

    Sep 9, 2026Linghan Zhong, Jiyang Zhang, Jayanth Srinivasa +2Code Generation

  22. CS-Guard: Benchmarking LLM Guardrails for Code Generation Security

    Sep 9, 2026Jinyang Li, Mingyu Guo, Hung X. NguyenLarge Language Model SafetyCode Generation

  23. CausalVerify: An Execution-Grounded Benchmark for LLM Causal Inference Workflows

    Sep 7, 2026Yonghong Zhang, Ricardo Correia, Isabel M. Parra +1Causal InferencesCode Generation

  24. CodeTD: Topology of Attention Detects Hallucinations in Code LLMs

    Sep 7, 2026Daria Voronkova, Ilya Trofimov, Anton Dmitriev +3Code GenerationCorrectness

  25. Adaptive Critical Token-Aware Retrieval for Repository-Level Code Generation

    Sep 1, 2026Kefeng Duan, Dewu Zheng, Yanlin Wang +8Code GenerationLarge Language Model Generation

  26. Designing Proactive Thought Partners for Writing

    Sep 1, 2026Chao Zhang, Abe Davis, Chih-Wei Chen +1Ai-Assisted WritingProactive

  27. WiseSpec: Requirements-Driven Agents for Code Generation

    Sep 1, 2026Zhao TianCode GenerationSoftware Engineering

  28. LLM Post-Training as Brownfield Maintenance: An Industrial Perspective on Dataware Engineering

    Aug 31, 2026Gopi Krishnan Rajbahadur, Amir M. Ebrahimi, Boyuan Chen +1Post-TrainingTraining Data

  29. Interpreting and Steering for Safe and Correct Code Generation

    Aug 30, 2026Hao Yan, Ziyu YaoLarge Language Model SafetyVulnerable Code

  30. Rubric-to-Code Credit Assignment for Reinforcement Learning

    Aug 28, 2026Rui Jin, Jikai Chen, Yihan Chen +6Code GenerationCredit Assignment

  31. AutoResearch: Insight In, Hallucination Out

    Aug 18, 2026Xiang Liu, Qumeng Sun, Bruno +3Research AutomationCode Generation

  32. LigBench: A Unified and Human-Aligned Benchmark for LLM-based Research Idea Generation

    Aug 13, 2026Chenrun Wang, Mingxuan Zhu, Tiancheng Huang +6Scientific IdeationCode Generation

  33. From Visual Widgets to UI Code: Efficient Tool-Grounded Generation

    Aug 12, 2026Houston H. Zhang, Tao Zhang, Li Gu +5Image-To-Code GenerationGenerative User Interface

  34. Do Influence Tactics Matter? Investigating Prompt Framing Effects in LLM Code Generation

    Aug 11, 2026Alex Deaconu, Anubhav Gupta, Manaal Basha +2Code GenerationTask Framing

  35. P3^{3}: Joint Program-and-Proof Planning for Verified Code Generation

    Aug 10, 2026Zenan Li, Ziran Yang, Peiyang Song +2Code GenerationFormal Verification

  36. A Unified Issue Resolution Benchmark for Requirement Clarification, Planning, and Code Generation for Coding Agents

    Aug 10, 2026Xin Zhou, Chun Yong Chong, Kisub Kim +11Coding AgentsCode Generation

  37. Curriculum as Code: An AI-Assisted Architecture for Instructional Design in STEM Education

    Aug 7, 2026Henrique Mohallem PaivaArtificial Intelligence EducationPedagogical Frameworks

  38. Characterizing the Quality Profile of AI-Generated C++ in Production

    Aug 6, 2026Michael Tran, Fred Lewis, Kun Yang +5Code QualityCode Generation

  39. RA-CAD: Learning Post-Execution Critique for State-Aware Text-to-CAD Generation

    Aug 6, 2026Shuhao Yan, Changhao He, Peng Hu +1Image-To-Cad GenerationCode Generation

  40. Improving Auto-Design of Neural PDE Solvers with a Domain-Specific Language

    Aug 5, 2026Shengxin Kong, Liwen Xu, Jingwen FuNeural Partial Differential Equation SolversEvolutionary Search

  41. COMPAS: Difficulty-Aware Joint Search for Optimizing Code Generation

    Aug 5, 2026Jingzhi Gong, Jie M. Zhang, Gunel Jahangirova +3Code GenerationCode Optimization

  42. Adversarial Fast-Moving Real-World Domains as Test Beds for Benchmarking AI Scientist Capabilities

    Aug 4, 2026William Bolton, Philip TorrScientific IdeationArtificial Intelligence Benchmarks

  43. Route-Align-Verify for Functional Correctness in Code Generation

    Aug 4, 2026Erxue Zhou, Jingxiang Meng, Aofan LiuCode GenerationLarge Language Model Generation

  44. Effective and Efficient Context Retrieval via Partial Dependency Graph for Repository-Level Code Generation

    Aug 3, 2026Zhongxin Liu, Zhonghao Jiang, Zhifan Ye +3Code GenerationGraph-Based Retrieval Augmented Generation

  45. Style Wins, Substance Loses: A Diagnosis of LLM-as-Judge in Idea Generation

    Aug 3, 2026Fengxian Ji, Yuke Li, Jingpu Yang +8Scientific IdeationLlm-As-A-Judge

  46. Security-First Evaluation of Text-to-Terraform: Benchmarking LLMs and SLMs for Secure IaC Generation

    Aug 2, 2026Francis Luis Santos Vargas, Rodrigo Brandão Mansilha, Diego KreutzLarge Language Model SafetyCode Generation

  47. TaPR: Test-Aware Policy Refinement for Feedback-Conditioned Code Generation

    Aug 1, 2026Aofan Liu, Jingxiang Meng, Fangxin Liu +1Code GenerationRetrying

  48. When Specifications Conflict: A Symmetry-Based Framework for Measuring LLM Preferences

    Jul 30, 2026Tairan Wang, Liang Zhou, Zikang Zhan +1Preference Alignment LearningCode Generation

  49. Metaphor-Induced Algorithmic Steering: Cross-Domain Procedural Transfer in LLM Code Generation

    Jul 30, 2026Zhibo Hu, Chen Wang, Yanfeng Shu +3Code GenerationMetaphors

  50. Drawing-Recode: Annotation Grounding for Parametric CAD Code Generation from Raster 2D CAD Drawings

    Jul 30, 2026Mingi Kim, Yongjun Kim, Hyungki KimParametric Computer-Aided Design ProgramsSketches

  51. RLPF: Reinforcement Learning from Performance Feedback for Code Generation

    Jul 29, 2026Huihao Jing, Haozhe Cui, Wenbin Hu +9Code GenerationFeedback