Vulnerable Code

Momentum

8 papers in the last four weeks, up 167% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 56

All topics
CardsList
  1. CodeMimicry: Exploiting Safety Generalization Lag in Large Language Models via Structured Code Completion

    Sep 30, 2026Zhen Liang, Hai Huang, Wentao ChenJailbreak AttacksVulnerable Code

  2. Metrics Failure in LLM-Based Code Vulnerability Repair: An Empirical Study and a Change-Aware Screen

    Sep 22, 2026Om Nepal, Sushant Aryal, Oluseyi Olukola +1Vulnerable CodeCode Quality

  3. TraceVIC: Causal Reasoning over Code Evolution for Identifying Vulnerability-Inducing Commits

    Sep 22, 2026Fnu Tanish, Samiha Shimmi, Samikshya Chapagain +3Vulnerable CodeCommits

  4. Trust, but Validate the Instrument: Auditing AI-Generated RTL Verification Plans on Authored Security-Regression Proxies

    Sep 17, 2026Hang Xiao, Chuhong Xu, Kainan Zhou +2Runtime EnforcementModel Auditing

  5. Reflections on Trusting Trust, Revisited: Contaminating Self-Modifying AI Coding Agents with Poisoned Benchmarks

    Sep 15, 2026Franziska Roesner, Tadayoshi KohnoCoding AgentsPoisoning

  6. Vulnerability Localization Benchmark: Measuring Agentic Security Analysis at Repository Scale

    Sep 14, 2026Aman Priyanshu, Supriti Vijay, Kimia Majd +8Model VulnerabilitiesVulnerable Code

  7. What is the Difference Between Me and You? Benchmarking the Quality Gap Between Human-Written and AI-Generated Code

    Sep 14, 2026Cristina Improta, Pietro Liguori, Domenico CotroneoCode QualityCode Generation

  8. Beyond Static Guarantees: Measuring the Static-Pass Dynamic-Fail Gap in Security-Sensitive and LLM-Generated Python Code

    Sep 12, 2026Jessica Pourleyli, Maitreyee Das Urmi, Glaucia MeloProgram AnalysisVulnerable Code

  9. Beyond the Payload: How User Invocation Shapes Coding Agent Vulnerability to Repository Poisoning

    Aug 31, 2026Fukang Zhu, Binbin Zhao, Ruixiao Lin +3Coding AgentsVulnerable Code

  10. Interpreting and Steering for Safe and Correct Code Generation

    Aug 30, 2026Hao Yan, Ziyu YaoLarge Language Model SafetyVulnerable Code

  11. Antares: Foundation Models for Agentic Vulnerability Localization

    Aug 3, 2026Supriti Vijay, Aman Priyanshu, Didier Chapoteau +8Vulnerable CodeCybersecurity

  12. Graph Is the Verifier: Agentic Reinforcement Learning for Interprocedural Vulnerability Detection

    Jul 29, 2026Yikun Li, Ting Zhang, Jiakun Liu +9Vulnerable CodeAgentic Reinforcement Learning

  13. The Illusion of Secure LLM Code: Closing the Security Gap via Iterative Reprompting

    Jul 26, 2026Ishpuneet Singh, Shreyas Mahajan, Gurjot Singh +1Large Language Model SafetyVulnerable Code

  14. Poster: Rethinking Security in LLM Code Generation through Real-World Risk Scenarios

    Jul 25, 2026Lixun Ma, Ruolong Ma, Bei Wang +4Large Language Model SafetyVulnerable Code

  15. IssueTrojanBench: Benchmarking AI Coding Agents Against Malicious Issue Requests

    Jul 22, 2026Ankur Singh, Jinqiu Yang, Tse-Hsun ChenCoding AgentsVulnerable Code

  16. Tool-Guided Retrieval-Augmented Repair for Securing LLM-Generated C Code

    Jul 21, 2026Vidyut Sriram, Saatvik Pradhan, Suman SahaProgram AnalysisVulnerable Code

  17. Democratizing Agent Deployment Safety: A Structural Monitoring Approach

    Jul 16, 2026Preeti Ravindra, Rahul Tiwari, Vincent WolowskiAgentic DeploymentsSecurity Evaluation

  18. Do These Violent Delights Have Violent Ends? Measuring the Post-Merge Fate of Agentic Code

    Jul 10, 2026Chunqiu Steven Xia, Courtney MillerPull RequestsCoding Agents

  19. Beware What You Autocomplete: Forensic Attribution of Backdoored Code Completions

    Jul 9, 2026Anjun Gao, Yueyang Quan, Zhuqing Liu +1Clean Label Backdoor AttackVulnerable Code

  20. Functional and Secure Code Generation with Task Vectors

    Jul 8, 2026Felix Wang, Anudeep Das, Mei Nagappan +1Code GenerationLarge Language Model Safety

  21. Refused in Chat, Written in Code: Workflow-Level Jailbreak Construction in IDE Coding Agents

    Jul 4, 2026Abhishek Kumar, Carsten MapleCoding AgentsLarge Language Model Safety

  22. An Empirical Study of Security Calibration in Large Language Models for Code

    Jun 30, 2026Mohammed Latif Siddiq, Md. Nafiu Rahman, Joanna C. S. SantosLarge Language Model SafetyVulnerable Code

  23. Vulnerability of Natural Language Classifiers to Evolutionary Generated Adversarial Text

    Jun 25, 2026Manjinder Singh, Alexander E. I. Brownlee, Mohamed ElawadyLarge Language Model ClassificationVulnerable Code

  24. Detecting and Understanding Vulnerabilities in Fully Homomorphic Encryption Frameworks

    Jun 21, 2026Yiteng Peng, Dongwei Xiao, Zhibo Liu +2Homomorphic EncryptionVulnerable Code

  25. Local LLM Agents as Vulnerable Runtimes:A Source-Code Audit of the Agent Runtime Layer

    Jun 19, 2026Zhengsong Zhang, Zongze Li, Jiawei Guo +1OpenclawVulnerable Code

  26. Secure Coding Drift in LLM-Assisted Post-Quantum Cryptography Development: A Gamified Fix

    Jun 17, 2026R. D. N. Shakya, C. P. Wijesiriwardana, S. M. Vidanagamachchi +1Post-Quantum CryptographyVulnerable Code

  27. Code-Augur: Agentic Vulnerability Detection via Specification Inference

    Jun 17, 2026Zhengxiong Luo, Mehtab Zafar, Dylan Wolff +1Vulnerable CodeSystemverilog Assertions

  28. SPARK: Security Knowledge Priming and Representation-Guided Knowledge Activation for LLM-based Secure Code Generation

    Jun 15, 2026Xiaoyun Xu, Lichao Wu, Jona te Lintelo +2Large Language Model SafetyVulnerable Code

  29. Willing but Unable: Separating Refusal from Capability in Code LLMs via Abliteration

    Jun 3, 2026Cristina Carleo, Pietro Liguori, Naghmeh Ivaki +1Vulnerable CodeLarge Language Model Safety

  30. Learn from Your Mistakes: Tree-like Self-Play for Secure Code LLMs

    Jun 2, 2026Wenqi Chen, Ziyan Zhang, Bin Wang +3Vulnerable CodeLarge Language Model Safety

  31. Dissecting the Black Box: Circuit-Level Analysis of LLM Vulnerability Detection

    May 28, 2026Syafiq Al Atiiq, Chun Zhou, Christian GehrmannVulnerable CodeLarge Language Model Safety

  32. Minimal Prompt Perturbations Lead to Code Vulnerabilities: Prompt Fragility and Hidden-State Signals in Coding LLMs

    May 28, 2026Alexander Sternfeld, Andrei Kucharavy, Ljiljana DolamicVulnerable CodeAi-Assisted Programming Tasks

  33. Poison with Style: A Practical Poisoning Attack on Code Large Language Models

    May 26, 2026Khang Tran, Yazan Boshmaf, Issa Khalil +3Attacker Large Language ModelPoisoning

  34. Lessons from Penetration Tests on Large-Scale Agent Systems

    May 26, 2026Kevin Eykholt, Dhilung Kirat, Xiaokui Shu +3Penetration TestingVulnerable Code

  35. Enhancing Reliability in LLM-Based Secure Code Generation

    May 22, 2026Mohammed F. Kharma, Mohammad Alkhanafseh, Ahmed Sabbah +1Large Language Model SafetyVulnerable Code

  36. An Empirical Evaluation of LLM-Generated Code Security Across Prompting Methods

    May 22, 2026Mohammed Kharma, Ahmed Sabbah, Mohammad Alkhanafseh +2Code GenerationVulnerable Code

  37. Security of LLM-generated Code: A Comparative Analysis

    May 21, 2026Srivathsan G Morkonda, Mahmoud Selim, Hala AssalVulnerable CodeCode Generation

  38. ExploitBench: A Capability Ladder Benchmark for LLM Cybersecurity Agents

    May 13, 2026Seunghyun Lee, David BrumleyExploitationVulnerable Code

  39. Natural Language based Specification and Verification

    May 11, 2026Zhaorui Li, Chengyu SongLarge Language Model SafetyVulnerable Code

  40. ExploitGym: Can AI Agents Turn Security Vulnerabilities into Real Attacks?

    May 11, 2026Zhun Wang, Nico Schiller, Hongwei Li +13ExploitationVulnerable Code

  41. Correct Code, Vulnerable Dependencies: A Large Scale Measurement Study of LLM-Specified Library Versions

    May 7, 2026Chengjie Wang, Jingzheng Wu, Xiang Ling +2Vulnerable CodeCode Quality

  42. MOSAIC-Bench: Measuring Compositional Vulnerability Induction in Coding Agents

    May 5, 2026Jonathan Steinberg, Oren GalVulnerable CodeCoding Agents

  43. From Concept-Aligned Tokens to Vulnerable Features: Mechanistic Localization of Jailbreaks

    Apr 25, 2026Nilanjana Das, Mathew Dawit, Aman Chadha +1Jailbreak Success RatesUnsafe

  44. QuanForge: A Mutation Testing Framework for Quantum Neural Networks

    Apr 22, 2026Minqi Shao, Shangzhou Xia, Jianjun ZhaoQuantum Neural NetworksNeural Network

  45. SynthFix: Adaptive Neuro-Symbolic Code Vulnerability Repair

    Apr 19, 2026Yifan Zhang, Jieyu Li, Kexin Pei +2Automated Program RepairRepair

  46. Surgical Repair of Insecure Code Generation in LLMs

    Apr 17, 2026Gustavo Sandoval, Brendan Dolan-Gavitt, Siddharth GargVulnerable CodeModel Vulnerabilities

  47. Detecting Data Poisoning in Code Generation LLMs via Black-Box, Vulnerability-Oriented Scanning

    Mar 17, 2026Shenao Yan, Shan Jin, Shimaa Ahmed +4Vulnerable CodeAttacker Large Language Model

  48. Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks

    Dec 2, 2025Songwen Zhao, Danqing Wang, Kexun Zhang +3Vibe CodingVulnerable Code

  49. RedCoder: Automated Multi-Turn Red Teaming for Code LLMs

    Jun 25, 2025Wenjie Jacky Mo, Qin Liu, Xiaofei Wen +5Red-TeamingCode Generation

  50. ANVIL: Anomaly-based Vulnerability Identification without Labelled Training Data

    Aug 28, 2024Weizhou Wang, Eric Liu, Xiangyu Guo +3Vulnerable CodeAnomaly Score

  51. Toward Secure Code Generation: Bridging Correctness and Security via Task-Adaptive Vulnerability Modeling and Execution-Based Benchmarking

    Jul 2, 2024Jiexin Wang, Liuwen Cao, Xitong Luo +6Code GenerationVulnerable Code