Code Language Models

Momentum

10 papers in the last four weeks, up 150% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 85

All topics
CardsList
  1. Obey, Diverge, Collapse: Blind Obedience to Incorrect Instructions Drives Code LLMs to Irrecoverable Code Semantic Collapse

    Jul 5, 2026Raj Jaiswal, Anany Singh Divy, Savar Bhasin +3LLM Self-CorrectionAutomated Program Repair

  2. Teaching Code LLMs to Reason with Intermediate Formal Specifications

    Jul 5, 2026Minh Le-Anh, Cuong Chi Le, Tien N. NguyenFormal VerificationCode Language Models

  3. Benchmarking Large Language Models on Floating-Point Error Classification

    Jun 30, 2026Lisa Taldir, Muhammad Ahmad Saeed, David Defour +2LLM EvaluationStatic Code Analysis

  4. SrDetection: A Self-Referential Framework for Data Leakage Detection in Code Large Language Models

    Jun 29, 2026Shuaimin Li, Liyang Fan, Zeyang Li +9LLM EvaluationLLM Auditing

  5. When AI Reviews Its Own Code: Recursive Self-Training Collapse in Code LLMs

    Jun 26, 2026Xinyuan Song, Zekun Cai, Liang ZhaoSelf-TrainingModel Collapse

  6. Recall Before Rerank: Benchmarking Deep Learning Models for Large-Scale Code-to-Code Retrieval

    Jun 24, 2026Leonardo Venuta, Francesco Tosoni, Paolo FerraginaLLM EvaluationSemantic Search

  7. Dream at SemEval-2026 Task 13: SALSA for Single-Pass Machine-Generated Code Detection

    Jun 23, 2026Ruslan Berdichevsky, Shai Nahum-Gefen, Elad Ben-ZakenOOD GeneralizationCode Language Models

  8. From Brewing to Resolution: Tracing the Internal Lifecycle of Code Reasoning in LLMs

    Jun 16, 2026Siyue Chen, Yifu Guo, Yuquan Lu +9LLM InterpretabilityCode Language Models

  9. Beyond Correctness: Enhancing Architectural Reasoning in Code LLMs via Scalable Labeling with Agentic Judgment

    Jun 12, 2026Kirill Vasilevski, Ximing Dong, Benjamin Rombaut +8Software Engineering AgentsLLM-as-a-Judge

  10. Detecting Functional Memorization in Code Language Models

    Jun 11, 2026Matthieu Meeus, Anil Ramakrishna, Matthew Grange +2Memorization in Language ModelsLLM Auditing

  11. CODEBLOCK: Learning to Supervise Code at the Right Granularity

    Jun 10, 2026Zhijie Deng, Ling Li, Jinlong Pang +5Supervised Fine-TuningCode Language Models

  12. CodeAlchemy: Synthetic Code Rewriting at Scale

    Jun 8, 2026Ankit Gupta, Aditya Prasad, Rameswar PandaSynthetic Data PretrainingSynthetic Data Generation

  13. Code Is More Than Text: Uncertainty Estimation for Code Generation

    Jun 8, 2026Yuling Shi, Caiqi Zhang, Yuexian Li +4Confidence Estimation in Language ModelsLLM Reliability

  14. Beyond Pass Rate: A Multilingual, Execution-Grounded Evaluation of Open Code LLMs

    Jun 7, 2026Sayed Erfan ArefinCode Generation EvaluationCode Language Models

  15. Code as a Weapon: A Consensus-Labeled Prompt Bank for Measuring Coding-Model Compliance with Malicious-Code Requests

    May 27, 2026Richard J. Young, Gregory D. MoodyClassificationLLM Safety Evaluation

  16. Poison with Style: A Practical Poisoning Attack on Code Large Language Models

    May 26, 2026Khang Tran, Yazan Boshmaf, Issa Khalil +3LLM Backdoor AttacksData Poisoning Attacks

  17. Merge-Bench: Resolve Merge Conflicts with Large Language Models

    May 25, 2026Benedikt Schesch, Michael D. ErnstSoftware EngineeringCode Language Models

  18. TRACER: A Semantic-Aware Framework for Fine-Grained Contamination Detection in Code LLMs

    May 22, 2026Yifeng Di, Xuliang Huang, Tianyi ZhangLLM AuditingData Contamination in Language Models

  19. Syntax Without Semantics: Teaching Large Language Models to Code in an Unseen Language

    May 15, 2026Vinayshekhar Bannihatti Kumar, Disha Makhija, Manoj Ghuhan Arivazhagan +1LLM Fine-TuningCode Language Models

  20. Code-Centric Detection of Vulnerability-Fixing Commits: A Unified Benchmark and Empirical Study

    May 13, 2026Nils Loose, Joseph Bienhüls, Kristoffer Hempel +2Software Vulnerability DetectionSoftware Engineering Benchmarks

  21. SemChunk-C: Semantic Segmentation for C Code

    May 12, 2026Boris Nazarov, Darya Frolova, Shaked Leibzirer +1Small Language ModelsCode Language Models