Model Vulnerabilities

Momentum

5 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 39

All topics
CardsList
  1. Does AI Help Cyber Attackers or Defenders? Evidence from Nonpublic Vulnerabilities and Subsequent Attacks

    Oct 5, 2026Tobias Heldt, Matt Turk, Christoph Landolt +1Model Vulnerabilities

  2. Retrieve, Reproduce, Reveal: Dissecting Retrieval-Augmented Software Vulnerability Detection

    Sep 29, 2026Sabrina Kaniewski, Tim Krämer, Julius Bächle +3Model VulnerabilitiesSoftware

  3. Cheap to Hypothesize, Costly to Verify: The Defense Surface of Agentic Vulnerability Discovery

    Sep 28, 2026Kaikai Zhang, Zihan Zhang, Yuchong Xie +4Model VulnerabilitiesHypothesis

  4. Vulnerability Localization Benchmark: Measuring Agentic Security Analysis at Repository Scale

    Sep 14, 2026Aman Priyanshu, Supriti Vijay, Kimia Majd +8Model VulnerabilitiesVulnerable Code

  5. No-Box Vulnerability Analysis: Description-only Detection of Indirect Prompt Injection Vulnerabilities in MCP Servers

    Sep 9, 2026Zehua Zhang, Jie Hu, Pratham Hegde +13Common Vulnerabilities And ExposureModel Vulnerabilities

  6. VEX-Bench: Benchmarking LLM Agents for Assessing Exploitability of Software Supply Chain Vulnerabilities

    Sep 7, 2026Jiahao Shi, Edward Tsien, Yifeng Di +10Model VulnerabilitiesExploitation

  7. Athena: Vulnerability-Affected Library Identification via Knowledge Graph Completion

    Sep 1, 2026Phong Trinh Duy, Trang Dang Yen, Hung Nguyen-Huu +5Model VulnerabilitiesCommon Vulnerabilities And Exposure

  8. EntailLLM: Verifying LLM-Generated Vulnerability Discovery Paths with Domain Knowledge via Logic Programming

    Aug 3, 2026Kaustuv Mukherji, Jaikrishna Manojkumar Patil, Colton Payne +4Model VulnerabilitiesGraph Representations

  9. Cyber-Capable AI Agents: Vulnerabilities, Evaluation Containment, and Defensive Response

    Jul 28, 2026Abu Bakar SiddikCybersecurityModel Vulnerabilities

  10. Using Fine-Tuned LLMs to Identify Indicators of Vulnerability in UK Police Incident Logs

    Jul 20, 2026Sam Relins, Daniel BirksPolicingModel Vulnerabilities

  11. Beyond Refusal: A Same-Lineage Study of Aligned and Abliterated LLMs for Vulnerability Analysis

    Jul 7, 2026Mingchen Li, Meikang Qiu, Zifan Peng +4Large Language Model SafetyModel Vulnerabilities

  12. A Lifecycle and Application-Stack Survey of Large Language Model Vulnerabilities: Attacks, Risks, Defenses, and Open Problems

    Jun 30, 2026Seyed Bagher Hashemi Natanzi, Bo TangLarge Language Model SafetyModel Vulnerabilities

  13. CyberChainBench: Can AI Agents Secure Smart Contracts Against Real-World On-Chain Vulnerabilities?

    Jun 24, 2026Jintao Huang, Fengqing Jiang, Radha Poovendran +1Smart ContractsModel Vulnerabilities

  14. Evaluating LLMs for Real-World Web Vulnerability Detection

    Jun 19, 2026Sebastian Neef, Luca Jungnickel, Antonio Benjamin Buchholz +2Model VulnerabilitiesAttacker Large Language Model

  15. Data-Centric Benchmarking of Exploit Generation in LLMs: Understanding the Impact of Fine-Tuning

    Jun 13, 2026Yiwei Chen, Lichi Li, Kai Cheung +2Model VulnerabilitiesExploitation

  16. SEC-bench Pro: Can Language Models Solve Long-Horizon Software Security Tasks?

    May 26, 2026Hwiwon Lee, Jiawei Liu, Dongjun Kim +3Model VulnerabilitiesSecurity Evaluation

  17. Demystifying the Mythos or Disrupting Bugonomics? From Zero-Day Asymmetry to Defender Remediation Throughput

    May 23, 2026Alfredo Pesoli, Herman Errico, Lorenzo CavallaroModel VulnerabilitiesRemediation

  18. PromptAudit: Auditing Prompt Sensitivity in LLM-Based Vulnerability Detection

    May 22, 2026Steffen J. Camarato, Yahya Hmaiti, Mandana Ghadamian +1Model VulnerabilitiesCommon Vulnerabilities And Exposure

  19. Known By Their Actions: Fingerprinting LLM Browser Agents via UI Traces

    May 14, 2026William Lugoloobi, Samuelle Marro, Jabez Magomere +2Attacker Large Language ModelFingerprint

  20. DCVD: Dual-Channel Cross-Modal Fusion for Joint Vulnerability Detection and Localization

    May 10, 2026Wenxin Tang, Wenbin Li, Junliang Liu +10Model VulnerabilitiesWhite-Box Spectral-Subspace-Guided Attack

  21. Tailored Prompts, Targeted Protection: Vulnerability-Specific LLM Analysis for Smart Contracts

    May 5, 2026Xing Zhang, Keyu Zhang, Taohong Zhu +1Smart ContractsModel Vulnerabilities

  22. When RAG Chatbots Expose Their Backend: An Anonymized Case Study of Privacy and Security Risks in Patient-Facing Medical AI

    May 1, 2026Alfredo Madrid-García, Miguel RujasChatbotsPrivacy

  23. Tatemae: Detecting Alignment Faking via Tool Selection in LLMs

    Apr 29, 2026Matteo Leonesi, Francesco Belardinelli, Flavio Corradini +1DeceptionModel Vulnerabilities

  24. Taint-Style Vulnerability Detection and Confirmation for Node.js Packages Using LLM Agent Reasoning

    Apr 22, 2026Ronghao Ni, Mihai Christodorescu, Limin JiaModel Vulnerabilities

  25. An Empirical Study of Multi-Generation Sampling for Jailbreak Detection in Large Language Models

    Apr 20, 2026Hanrui Luo, Shreyank N GowdaLarge Language Model JailbreaksJailbreak Attacks

  26. Surgical Repair of Insecure Code Generation in LLMs

    Apr 17, 2026Gustavo Sandoval, Brendan Dolan-Gavitt, Siddharth GargVulnerable CodeModel Vulnerabilities

  27. SoK: Systematizing LLM Prompt Security: Taxonomies, Datasets, and Unified Evaluation of Attacks and Defenses

    Oct 17, 2025Hanbin Hong, Shuang Wu, Shuya Feng +6Large Language Model SafetyLarge Language Model Evaluation

  28. On the Existence of Consistent Adversarial Attacks in High-Dimensional Linear Classification

    Jun 14, 2025Matteo Vilucchio, Lenka Zdeborová, Bruno LoureiroEmpirical Risk MinimizationModel Vulnerabilities

  29. Toward Secure Code Generation: Bridging Correctness and Security via Task-Adaptive Vulnerability Modeling and Execution-Based Benchmarking

    Jul 2, 2024Jiexin Wang, Liuwen Cao, Xitong Luo +6Code GenerationVulnerable Code