Software Security

Latest papers 61

All topics
CardsList
  1. AuraForge: Scaling Security Supervision for Training Coding Agents

    Oct 1, 2026Danqing Wang, Songwen Zhao, Harsh Sharma +4AI Coding AgentsSoftware Security

  2. Evaluating Coding Agents on Kernel Exploit Generation

    Sep 22, 2026Junyoung Jang, Gwanhyun Lee, Hwiwon Lee +4AI Coding AgentsSoftware Security

  3. Seeing is Not Believing: Breaking the Physical-to-Digital Trust Boundary in Robotics

    Sep 8, 2026Leming Shen, Shikai Geng, Yuanqing Zheng +1CybersecuritySoftware Security

  4. VEX-Bench: Benchmarking LLM Agents for Assessing Exploitability of Software Supply Chain Vulnerabilities

    Sep 7, 2026Jiahao Shi, Edward Tsien, Yifeng Di +10LLM Agent EvaluationSoftware Security

  5. CodePoisonRAG: Knowledge Poisoning Attacks on Retrieval-Augmented Code Generation

    Sep 2, 2026Varun Gadey, Ziad Marey, Alexandra DmitrienkoData Poisoning AttacksSoftware Security

  6. Automated Vulnerability Injection in Smart Contracts Using Large Language Models

    Sep 2, 2026Luca Migliaccio, Roberto Natella, Naghmeh Ivaki +2Software SecuritySoftware Vulnerability Detection

  7. Athena: Vulnerability-Affected Library Identification via Knowledge Graph Completion

    Sep 1, 2026Phong Trinh Duy, Trang Dang Yen, Hung Nguyen-Huu +5Software SecurityKG Completion

  8. MACGen: Toward Functionally Correct and Secure Code Generation via Multi-Agent Collaboration

    Aug 26, 2026Miseon Yu, Jaehoon Choi, Younghan Lee +1Code GenerationSecure Code Generation

  9. CyberFactory: Scaling Cyber Security Capabilities with Instances from the Wild

    Aug 24, 2026Jian Yang, Haau-Sing Li, Shawn Guo +10CybersecuritySoftware Security

  10. Vulnerabilities, Secrets and Misconfiguration in the Highest-Exposure Docker Hub Images

    Aug 2, 2026Cristhian Kapelinski, Beatriz Machado, Diego KreutzSoftware Vulnerability DetectionCybersecurity

  11. An AI Approach to Verified Production Cryptographic Libraries

    Aug 2, 2026Chuyue Sun, Su Fong, Zhiyi Kuang +5Software SecurityProgram Synthesis

  12. EduPluginBench: Executable Assurance for AI-Generated Educational Plugins

    Aug 1, 2026Nizam KadirSoftware SecurityRuntime Assurance

  13. The Illusion of Secure LLM Code: Closing the Security Gap via Iterative Reprompting

    Jul 26, 2026Ishpuneet Singh, Shreyas Mahajan, Gurjot Singh +1LLM PromptingCybersecurity

  14. Understanding the Impact of AI Code Assistants on Security API Usage: An Empirical Study

    Jul 13, 2026Zahra Mousavi, Chadni Islam, M. Ali Babar +2AI Coding AgentsSoftware Security

  15. Do These Violent Delights Have Violent Ends? Measuring the Post-Merge Fate of Agentic Code

    Jul 10, 2026Chunqiu Steven Xia, Courtney MillerSoftware EngineeringSoftware Engineering Agents

  16. Advanced Topic Modeling Techniques for Categorizing Software Vulnerabilities

    Jul 4, 2026Utkarsh Tiwari, Spoorthi M, Anirudh S +1Software Vulnerability DetectionTopic Modeling

  17. Mastermind: Strategy-grounded Learning for Repository-Scale Vulnerability Reproduction

    Jul 2, 2026Mingzhe Du, Luu Anh Tuan, Tianyi Wu +4Software Engineering AgentsCybersecurity

  18. CyberChainBench: Can AI Agents Secure Smart Contracts Against Real-World On-Chain Vulnerabilities?

    Jun 24, 2026Jintao Huang, Fengqing Jiang, Radha Poovendran +1Automated Program RepairSoftware Vulnerability Detection

  19. Red-Teaming the Agentic Red-Team

    Jun 23, 2026Dario Pasquini, Michal Bazyli, Taras Fedynyshyn +1Software SecurityAI Agent Security

  20. RAVEN: Agentic RAG for Automated Vulnerability Repair

    Jun 21, 2026Varun Gadey, Zijie Liu, Alexandra DmitrienkoRetrieval-Augmented GenerationAutomated Program Repair

  21. Execution-bound advisory automation for agentic AI: a reproducible AIBOM-driven CSAF-VEX framework

    Jun 16, 2026Petar Radanliev, Omar Santos, Carsten Maple +1CybersecuritySoftware Security

  22. ARVO: Atlas of Reproducible Vulnerabilities for Open-Source Software

    Jun 15, 2026Xiang Mei, Jordi Del Castillo, Pulkit Singh Singaria +8Software Security

  23. Can Open-Source LLM Agents Replace Static Application Security Testing Tools? An Empirical Assessment

    Jun 10, 2026Derek Yohn, Luke Flancher, Mirajul Islam +1Software Vulnerability DetectionLLM Agent Evaluation

  24. MPC-Patch-Bench: Security-Aware LLM Code Patch for Multi-Party Computation

    Jun 9, 2026Yukuan Zhang, Mengxin Zheng, Qian LouSecure Multi-Party ComputationLLM Evaluation

  25. When Safe Skills Collide: Measuring Compositional Risk in Agent Skill Ecosystems

    May 30, 2026Su Wang, Pin Qian, Yihang Chen +6Software SecurityAI Agent Security

  26. Separating Secrets from Placeholders: A Hybrid CNN-CodeBERT Framework for Three-Class Credential Leakage Detection

    May 29, 2026Maksuda Bilkis Baby, Khushika Shah, Naiyue Liang +1Data LeakageSoftware Security

  27. Lessons from Penetration Tests on Large-Scale Agent Systems

    May 26, 2026Kevin Eykholt, Dhilung Kirat, Xiaokui Shu +3Software SecurityAI Agent Security

  28. SEC-bench Pro: Can Language Models Solve Long-Horizon Software Security Tasks?

    May 26, 2026Hwiwon Lee, Jiawei Liu, Dongjun Kim +3Software Vulnerability DetectionSoftware Security

  29. Demystifying the Mythos or Disrupting Bugonomics? From Zero-Day Asymmetry to Defender Remediation Throughput

    May 23, 2026Alfredo Pesoli, Herman Errico, Lorenzo CavallaroSoftware Vulnerability DetectionSoftware Security

  30. Security of LLM-generated Code: A Comparative Analysis

    May 21, 2026Srivathsan G Morkonda, Mahmoud Selim, Hala AssalSoftware SecurityLLM Security

  31. MemRepair: Hierarchical Memory for Agentic Repository-Level Vulnerability Repair

    May 17, 2026Simiao Liu, Li Zhang, Fang Liu +3Automated Program RepairSoftware Security

  32. Benchmarking Mythos-Linked Bug Rediscovery

    May 17, 2026Isaac David, Arthur GervaisSoftware EngineeringSoftware Vulnerability Detection

  33. Detecting Privilege Escalation in Polyglot Microservices via Agentic Program Analysis

    May 15, 2026Penghui Li, Hong Yau Chong, Yinzhi Cao +1Software Vulnerability DetectionSoftware Security

  34. Autonomous Intelligent Agents for Natural-Language-Driven Web Execution with Integrated Security Assurance

    May 14, 2026Vinil Pasupuleti, Siva Rama Krishna Varma Bayyavarapu, Shrey TyagiAutomated Software TestingSoftware Security

  35. CHAINTRIX: A multi-pipeline LLM-augmented framework for automated smart-contract security auditing

    May 10, 2026Gabriela Dobrita, Simona-Vasilica Oprea, Adela BaraLLM AuditingSoftware Vulnerability Detection

  36. Beyond Reproducibility: Towards Security-Aware Evaluation of Research Artifacts

    May 7, 2026Nanda Rani, Christian RossowSoftware Vulnerability DetectionSoftware Security

  37. FixV2W: Correcting Invalid CVE-CWE Mappings with Knowledge Graph Embeddings

    Apr 24, 2026Sevval Simsek, Varsha Athreya, David StarobinskiKG EmbeddingCybersecurity

  38. Towards Secure Logging: Characterizing and Benchmarking Logging Code Security Issues with LLMs

    Apr 22, 2026He Yang Yuan, Xin Wang, Kundi Yao +3Automated Program RepairSoftware Vulnerability Detection

  39. A Quasi-Experimental Developer Study of Security Training in LLM-Assisted Web Application Development

    Apr 20, 2026Mohammed Kharma, Ahmed Sabbah, Radi Jarrar +3Software SecuritySecure Code Generation

  40. Walma: Learning to See Memory Corruption in WebAssembly

    Mar 25, 2026Oussama Draissi, Mark Günzel, Ahmad-Reza Sadeghi +1Software Vulnerability DetectionSoftware Security

  41. Is Vibe Coding Safe? Benchmarking Vulnerability of Agent-Generated Code in Real-World Tasks

    Dec 2, 2025Songwen Zhao, Danqing Wang, Kexun Zhang +3AI Coding AgentsSoftware Security