Penetration Testing

Momentum

4 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 28

All topics
CardsList
  1. Calibrated Decision Models for Autonomous Penetration-Testing Harnesses: JEV and Laya as System One Decision Layers for LLM-Driven Pentest Agents

    Sep 24, 2026Joas Antonio dos Santos BarbosaPenetration TestingDecisions

  2. PentestChain: A Cost-Aware, MCP-Orchestrated Framework for Automated Penetration Testing with Free-Tier LLMs

    Sep 16, 2026Rushabh Vipulkumar Patel, Dipo Dunsin, Mohammed Almaiah +1Penetration TestingCost-Aware

  3. Automating Attack Graph Construction for Agentic Pentesting. Towards Neuro-Symbolic Vulnerability Hunting

    Sep 14, 2026Oliver Stevanovic, Jasmin WachterPenetration TestingNeuro-Symbolic Framework

  4. Staying on the Attack Path: Structured State for Long-Horizon Automated Penetration Testing

    Sep 7, 2026Weizhe Wang, Yitong Zhang, Yao Zhang +4Penetration TestingDiverse Attacks

  5. AgentSnare: Learning to Delay, Divert, and Defuse Autonomous Penetration Agents

    Jul 29, 2026Ruoyu Wang, Heng Zhao, Renjie Wu +4Penetration Testing

  6. Know Your Agent: Reconnaissance-Driven Pentesting of AI Agents

    Jul 22, 2026Or Zion Eliav, Eyal Lenga, Shir Bernstien +1Penetration TestingArtificial Intelligence Agents

  7. Rethinking Penetration Testing for AI-Enabled Systems: From Resource Compromise to Behavioral Objective Violation

    Jul 15, 2026Mohammad Allahbakhsh, Mohammad Hassan Bahari, Moslem Attar-RaoufPenetration TestingAdversarial Evaluation

  8. VEXAIoT: Autonomous IoT Vulnerability EXploitation using AI Agents

    Jul 10, 2026Katherine Swinea, Kshitiz Aryal, Lopamudra Praharaj +1Penetration TestingInternet Of Thing

  9. Decoupling Reconnaissance and Exploitation: Measuring the Capability Boundaries of LLM-Based Web Penetration Testing

    Jun 24, 2026Liwei Yu, Shuo Li, Ming Zhou +2Penetration TestingExploitation

  10. The Emergence of Autonomous Penetration Capabilities in Large Language Model-Powered AI Systems

    Jun 11, 2026Jiaqi Luo, Jiarun Dai, Zhile Chen +8Penetration TestingAttacker Large Language Model

  11. Honeyval: A Comprehensive Evaluation Framework for LLM-powered HTTP Honeypots

    May 28, 2026Mark Vero, Fabian Kaczmarczyck, Ivan Petrov +6HoneypotsPenetration Testing

  12. Lessons from Penetration Tests on Large-Scale Agent Systems

    May 26, 2026Kevin Eykholt, Dhilung Kirat, Xiaokui Shu +3Penetration TestingVulnerable Code

  13. APT-Agent: Automated Penetration Testing using Large Language Models

    May 24, 2026William Guanting Li, Alsharif Abuadbba, Kristen Moore +1Penetration TestingAttacker Large Language Model

  14. Autonomous Intelligent Agents for Natural-Language-Driven Web Execution with Integrated Security Assurance

    May 14, 2026Vinil Pasupuleti, Siva Rama Krishna Varma Bayyavarapu, Shrey TyagiPenetration TestingBrowser Agent

  15. Cochise: A Reference Harness for Autonomous Penetration Testing

    May 12, 2026Andreas Happe, Jürgen CitoPenetration TestingTest Generation

  16. From Controlled to the Wild: Evaluation of Pentesting Agents for the Real-World

    May 11, 2026Pedro Conde, Henrique Branquinho, Valerio Mazzone +3Penetration TestingCyberattacks

  17. Pen-Strategist: A Reasoning Framework for Penetration Testing Strategy Formation and Analysis

    May 6, 2026Yasod Ginige, Pasindu Marasinghe, Sajal Jain +1Penetration TestingCybersecurity

  18. APIOT: Autonomous Vulnerability Management Across Bare-Metal Industrial OT Networks

    May 4, 2026Adel ElZemity, Budi Arief, Shujun Li +6Penetration TestingRemediation

  19. AnyPoC: Universal Proof-of-Concept Test Generation for Scalable LLM-Based Bug Detection

    Apr 13, 2026Zijie Zhao, Chenyuan Yang, Weidong Wang +3Bug DetectionBug

  20. NASimJax: A GPU-Accelerated Policy Learning Framework for Penetration Testing

    Mar 20, 2026Raphael Simon, José Carrasquel, Elli Makdis Antoun +2Penetration TestingSequential Scaling

  21. Learning Robust Penetration Testing Policies under Partial Observability: A systematic evaluation

    Sep 24, 2025Raphael Simon, Pieter Libin, Wim MeesPartially Observable Markov Decision ProcessPenetration Testing

  22. Toward Secure Code Generation: Bridging Correctness and Security via Task-Adaptive Vulnerability Modeling and Execution-Based Benchmarking

    Jul 2, 2024Jiexin Wang, Liuwen Cao, Xitong Luo +6Code GenerationVulnerable Code