Automated Penetration Testing

Latest papers 32

All topics
CardsList
  1. Calibrated Decision Models for Autonomous Penetration-Testing Harnesses: JEV and Laya as System One Decision Layers for LLM-Driven Pentest Agents

    Sep 24, 2026Joas Antonio dos Santos BarbosaProbability CalibrationCybersecurity

  2. Evaluating Coding Agents on Kernel Exploit Generation

    Sep 22, 2026Junyoung Jang, Gwanhyun Lee, Hwiwon Lee +4AI Coding AgentsSoftware Security

  3. PentestChain: A Cost-Aware, MCP-Orchestrated Framework for Automated Penetration Testing with Free-Tier LLMs

    Sep 16, 2026Rushabh Vipulkumar Patel, Dipo Dunsin, Mohammed Almaiah +1Automated Penetration TestingLLMs for Cybersecurity

  4. Automating Attack Graph Construction for Agentic Pentesting. Towards Neuro-Symbolic Vulnerability Hunting

    Sep 14, 2026Oliver Stevanovic, Jasmin WachterAutomated Penetration TestingNeuro-Symbolic AI

  5. Staying on the Attack Path: Structured State for Long-Horizon Automated Penetration Testing

    Sep 7, 2026Weizhe Wang, Yitong Zhang, Yao Zhang +4LLM Agent MemoryLLM Agent Security

  6. RangeFactory: Scalable Construction of Multi-Hop Cyber Ranges

    Aug 10, 2026Hanlin Jiang, Puyi Wang, Jiandong Jin +10CybersecurityAutomated Penetration Testing

  7. AgentSnare: Learning to Delay, Divert, and Defuse Autonomous Penetration Agents

    Jul 29, 2026Ruoyu Wang, Heng Zhao, Renjie Wu +4Autonomous Cyber DefenseCybersecurity

  8. Know Your Agent: Reconnaissance-Driven Pentesting of AI Agents

    Jul 22, 2026Or Zion Eliav, Eyal Lenga, Shir Bernstien +1AI Agent SecurityAI Agent Security Benchmarks

  9. VEXAIoT: Autonomous IoT Vulnerability EXploitation using AI Agents

    Jul 10, 2026Katherine Swinea, Kshitiz Aryal, Lopamudra Praharaj +1CybersecurityLLM Agent Security

  10. Decoupling Reconnaissance and Exploitation: Measuring the Capability Boundaries of LLM-Based Web Penetration Testing

    Jun 24, 2026Liwei Yu, Shuo Li, Ming Zhou +2LLM Agent EvaluationAI Agent Security Benchmarks

  11. Red-Teaming the Agentic Red-Team

    Jun 23, 2026Dario Pasquini, Michal Bazyli, Taras Fedynyshyn +1Software SecurityAI Agent Security

  12. The Emergence of Autonomous Penetration Capabilities in Large Language Model-Powered AI Systems

    Jun 11, 2026Jiaqi Luo, Jiarun Dai, Zhile Chen +8LLM EvaluationAI Agent Security Benchmarks

  13. CyberEvolver: Structured Self-Evolution for Cybersecurity Agents On the Fly

    May 25, 2026Yihe Fan, Changyi Li, Lichen Xu +4LLM Agent Self-ImprovementAutomated Penetration Testing

  14. APT-Agent: Automated Penetration Testing using Large Language Models

    May 24, 2026William Guanting Li, Alsharif Abuadbba, Kristen Moore +1LLM Hallucination MitigationAutomated Penetration Testing

  15. Autonomous Intelligent Agents for Natural-Language-Driven Web Execution with Integrated Security Assurance

    May 14, 2026Vinil Pasupuleti, Siva Rama Krishna Varma Bayyavarapu, Shrey TyagiAutomated Software TestingSoftware Security

  16. From Controlled to the Wild: Evaluation of Pentesting Agents for the Real-World

    May 11, 2026Pedro Conde, Henrique Branquinho, Valerio Mazzone +3Software Vulnerability DetectionAI Agent Evaluation

  17. Pen-Strategist: A Reasoning Framework for Penetration Testing Strategy Formation and Analysis

    May 6, 2026Yasod Ginige, Pasindu Marasinghe, Sajal Jain +1Automated Penetration TestingLLMs for Cybersecurity

  18. APIOT: Autonomous Vulnerability Management Across Bare-Metal Industrial OT Networks

    May 4, 2026Adel ElZemity, Budi Arief, Shujun Li +6Autonomous Cyber DefenseCybersecurity