LLMs for Cybersecurity

LLM: Large Language Model

Momentum

19 papers in the last four weeks, up 280% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 166

All topics
CardsList
  1. A Multi-Layer Cloud-IDS Pipeline with LLM and Adaptive Q-Learning Calibration

    May 15, 2026Syed Waqas Ali, Ibrar Ali Shah, Farzana Zahid +2Network Intrusion DetectionCybersecurity

  2. Detecting Privilege Escalation in Polyglot Microservices via Agentic Program Analysis

    May 15, 2026Penghui Li, Hong Yau Chong, Yinzhi Cao +1Software Vulnerability DetectionSoftware Security

  3. ExploitBench: A Capability Ladder Benchmark for LLM Cybersecurity Agents

    May 13, 2026Seunghyun Lee, David BrumleyAI Agent Security BenchmarksLLMs for Cybersecurity

  4. CTFusion: A CTF-based Benchmark for LLM Agent Evaluation

    May 12, 2026Dongjun Lee, Ga-eun Bae, Insu YunBenchmark ContaminationLLM Agent Evaluation

  5. Adversarial SQL Injection Generation with LLM-Based Architectures

    May 11, 2026Ali Karakoc, H. Birkan YilmazRetrieval-Augmented GenerationAdversarial Attacks

  6. ExploitGym: Can AI Agents Turn Security Vulnerabilities into Real Attacks?

    May 11, 2026Zhun Wang, Nico Schiller, Hongwei Li +13AI Agent SecurityAI Agent Security Benchmarks

  7. Threat Modelling using Domain-Adapted Language Models: Empirical Evaluation and Insights

    May 11, 2026Saba Pourhanifeh, AbdulAziz AbdulGhaffar, Ashraf MatrawyDomain AdaptationCybersecurity

  8. VulTriage: Triple-Path Context Augmentation for LLM-Based Vulnerability Detection

    May 10, 2026Wenxin Tang, Xiang Zhang, Junliang Liu +11Software Vulnerability DetectionStatic Code Analysis

  9. CyBiasBench: Benchmarking Bias in LLM Agents for Cyber-Attack Scenarios

    May 8, 2026Taein Lim, Seongyong Ju, Munhyeok Kim +2AI Agent Security BenchmarksLLMs for Cybersecurity

  10. HBEE: Human Behavioral Entropy Engine -- Pre-Registered Multi-Agent LLM Simulation of Peer-Suspicion-Based Detection Inversion

    May 8, 2026Vickson FerrelLLMs for CybersecurityAnomaly Detection

  11. LCC-LLM: Leveraging Code-Centric Large Language Models for Malware Attribution

    May 7, 2026Christopher G. Pedraza Pohlenz, Hassan Jalil Hadi, Ali Hassan +1LLMs for CybersecurityMalware Analysis

  12. Pen-Strategist: A Reasoning Framework for Penetration Testing Strategy Formation and Analysis

    May 6, 2026Yasod Ginige, Pasindu Marasinghe, Sajal Jain +1Automated Penetration TestingLLMs for Cybersecurity

  13. Tailored Prompts, Targeted Protection: Vulnerability-Specific LLM Analysis for Smart Contracts

    May 5, 2026Xing Zhang, Keyu Zhang, Taohong Zhu +1Software Vulnerability DetectionLLMs for Cybersecurity

  14. FunFuzz: An LLM-Powered Evolutionary Fuzzing Framework

    May 4, 2026Mario Rodríguez Béjar, B. Romera-Paredes, Jose L. Hernández-RamosEvolutionary OptimizationSoftware Vulnerability Detection

  15. APIOT: Autonomous Vulnerability Management Across Bare-Metal Industrial OT Networks

    May 4, 2026Adel ElZemity, Budi Arief, Shujun Li +6Autonomous Cyber DefenseCybersecurity

  16. LLM Ghostbusters: Surgical Package Hallucination Suppression via Adaptive Unlearning

    May 1, 2026Joseph Spracklen, Pedram Aghazadeh, Farinaz Koushanfar +1LLM Hallucination MitigationHallucination in Language Models

  17. Trident: Improving Malware Detection with LLMs and Behavioral Features

    Apr 30, 2026Rebecca Saul, Jingzhi Jiang, Elliott Chia +1Malware ClassificationLLMs for Cybersecurity

  18. XekRung Technical Report

    Apr 30, 2026Jiutian Zeng, Junjie Li, Chengwei Dai +13LLM Fine-TuningCybersecurity

  19. Toward Autonomous SOC Operations: End-to-End LLM Framework for Threat Detection, Query Generation, and Resolution in Security Operations

    Apr 30, 2026Md Hasan Saju, Akramul AzimCybersecurityLLMs for Cybersecurity

  20. Autonomous LLM Agents & CTFs: A Second Look

    Apr 29, 2026Youness Bouchari, Matteo Boffa, Marco Mellia +3LLM Agent OrchestrationAI Agent Security Benchmarks

  21. Towards Agentic Investigation of Security Alerts

    Apr 28, 2026Even Eilertsen, Vasileios Mavroeidis, Gudmund GrovCybersecurityAgentic Workflows

  22. Learning Generalizable Multimodal Representations for Software Vulnerability Detection

    Apr 28, 2026Zeming Dong, Yuejun Guo, Qiang Hu +5Representation LearningSoftware Vulnerability Detection

  23. CAN-QA: A Question-Answering Benchmark for Reasoning over In-Vehicle CAN Traffic

    Apr 27, 2026Jing Chen, Abhijay Deevi, Onat Gungor +1Temporal ReasoningNetwork Intrusion Detection

  24. PhySE: A Psychological Framework for Real-Time AR-LLM Social Engineering Attacks

    Apr 25, 2026Tianlong Yu, Yang Yang, Ziyi Zhou +5Vision-Language ModelsCybersecurity

  25. CyberCertBench: Evaluating LLMs in Cybersecurity Certification Knowledge

    Apr 22, 2026Gustav Keppler, Ghada Elbez, Veit HagenmeyerLLM EvaluationCybersecurity