LLMs for Cybersecurity

LLM: Large Language Model

Momentum

19 papers in the last four weeks, up 280% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 166

All topics
CardsList
  1. Benchmarking and Exploring the Capabilities of LLMs for Attack Investigations

    Jun 9, 2026Aniket Anand, Yiwei Hou, Daniel Fields +4LLM EvaluationCybersecurity

  2. SAGE: An LLM-driven Self Reflective Agentic Framework for Fraud Detection

    Jun 6, 2026Yichen Chen, Siying Li, Yuhang Liang +2Multi-Agent LLM SystemsFinancial Fraud Detection

  3. GenTI: Benchmarking LLMs for Autonomous IDPS Rule Generation for Unseen Attacks

    Jun 4, 2026Hassan Jalil Hadi, Rehana Yasmin, Ali ShokerNetwork Intrusion DetectionSynthetic Benchmark Generation

  4. Willing but Unable: Separating Refusal from Capability in Code LLMs via Abliteration

    Jun 3, 2026Cristina Carleo, Pietro Liguori, Naghmeh Ivaki +1LLM Safety AlignmentLLMs for Cybersecurity

  5. Large Byte Model: Teaching Language Models About Compiled Code

    Jun 1, 2026Florian Störtz, Catalin-Andrei Stan, Alexandru Dinu +4Malware ClassificationByte-Level Language Model

  6. IstGPT: LLM-based Anomaly Detection for Spatial-Temporal Graph in Industrial Systems

    Jun 1, 2026Yuchen Zhang, Ning Xi, Pengbin Feng +5Cyber-Physical SystemsIndustrial Anomaly Detection

  7. A New Framework for Cybersecurity Refusals in AI Agents

    May 31, 2026Eliot Krzysztof Jones, Mateusz Dziemian, Matt Fredrikson +1LLM Agent EvaluationLLM Refusal Behavior

  8. Honeyval: A Comprehensive Evaluation Framework for LLM-powered HTTP Honeypots

    May 28, 2026Mark Vero, Fabian Kaczmarczyck, Ivan Petrov +6LLMs for Cybersecurity

  9. Dissecting the Black Box: Circuit-Level Analysis of LLM Vulnerability Detection

    May 28, 2026Syafiq Al Atiiq, Chun Zhou, Christian GehrmannLLM InterpretabilitySoftware Vulnerability Detection

  10. Intelligent Detection and Mitigation of Carpet-Bombing DDoS Attacks in SDN Using Retrieval-Augmented Generation and Large Language Models

    May 25, 2026Mohammed N. Swileh, Shengli Zhang, Kai LeiNetwork Intrusion DetectionCybersecurity

  11. CyberEvolver: Structured Self-Evolution for Cybersecurity Agents On the Fly

    May 25, 2026Yihe Fan, Changyi Li, Lichen Xu +4LLM Agent Self-ImprovementAutomated Penetration Testing

  12. TTPrint: Evidence-Grounded TTP Extraction via Diverge-then-Converge Verification

    May 25, 2026Yutong Cheng, Changze Li, Raihan Sultan Pasha Basuki +3Cyber Threat IntelligenceDocument Information Extraction

  13. APT-Agent: Automated Penetration Testing using Large Language Models

    May 24, 2026William Guanting Li, Alsharif Abuadbba, Kristen Moore +1LLM Hallucination MitigationAutomated Penetration Testing

  14. CyberMaskQA: A Privacy-Aware Benchmark for Evaluating Large Language Models in Cybersecurity Question Answering

    May 23, 2026Matilda Gaddi, Jin Noh, Onat Gungor +1CybersecurityLLMs for Cybersecurity

  15. Demystifying the Mythos or Disrupting Bugonomics? From Zero-Day Asymmetry to Defender Remediation Throughput

    May 23, 2026Alfredo Pesoli, Herman Errico, Lorenzo CavallaroSoftware Vulnerability DetectionSoftware Security

  16. HIDBench: Benchmarking Large Language Models for Host-Based Intrusion Detection

    May 20, 2026Danyu Sun, Jinghuai Zhang, Yuan Tian +1LLM EvaluationCybersecurity

  17. PocketAgents: A Manifest-Driven Library of Autonomous Defense Agents

    May 20, 2026Sidnei Barbieri, Ágney Lopes Roth Ferraz, Lourenço Alves Pereira JúniorAutonomous Cyber DefenseLLM Agent Security

  18. GenAI-Driven Threat Detection with Microsoft Security Copilot

    May 20, 2026Scott Freitas, Amir GharibAutonomous Cyber DefenseCybersecurity

  19. Benchmarking Mythos-Linked Bug Rediscovery

    May 17, 2026Isaac David, Arthur GervaisSoftware EngineeringSoftware Vulnerability Detection

  20. GRID: Graph Representation of Intelligence Data for Security Text Knowledge Graph Construction

    May 15, 2026Liangyi Huang, Zichen Liu, Fei Shao +5KG ConstructionCyber Threat Intelligence

  21. Context, Reasoning, and Hierarchy: A Cost-Performance Study of Compound LLM Agent Design in an Adversarial POMDP

    May 15, 2026Igor Bogdanov, Chung-Horng Lung, Thomas Kunz +3Multi-Agent LLM SystemsLLM Agent Orchestration