Exploitation

Momentum

10 papers in the last four weeks, up 233% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 66

All topics
CardsList
  1. Exploiting Vulnerabilities: Universal Adversarial Attacks on Vision-Language-Action Models in Robotics

    Sep 30, 2026Songhua Yang, Ziyu Liu, Yuanwei Liu +5Diffusion-Based Vision-Language-ActionsAdversarial Examples

  2. Alignment via Training Against Probes Without Losing Monitorability

    Sep 29, 2026Lena Libon, Alexander Panfilov, Ben Rank +3Safety AlignmentModel Activations

  3. Let the Neurons Die: Exploiting ReLU-Induced Model Degradation

    Sep 28, 2026Kexin Li, Wenjun Qiu, Joshua Abraham +2Rectified Linear Unit NetworksNeurons

  4. SAGE: Structured Strategic Reasoning for Efficient LLM Game Playing

    Sep 28, 2026Zhiwei Chen, Tianchun Wang, Zhongtao Rao +3Strategic ReasoningLarge Language Model Agents

  5. Evaluating Coding Agents on Kernel Exploit Generation

    Sep 22, 2026Junyoung Jang, Gwanhyun Lee, Hwiwon Lee +4ExploitationCoding Agents

  6. Beyond Static Guarantees: Measuring the Static-Pass Dynamic-Fail Gap in Security-Sensitive and LLM-Generated Python Code

    Sep 12, 2026Jessica Pourleyli, Maitreyee Das Urmi, Glaucia MeloProgram AnalysisVulnerable Code

  7. Evaluating Context Segmentation in Locally Deployable SLMs for Cybersecurity CTF Tasks

    Sep 11, 2026Sebastiano Nordio, Michele LottoCybersecuritySmall Large Language Models

  8. VEX-Bench: Benchmarking LLM Agents for Assessing Exploitability of Software Supply Chain Vulnerabilities

    Sep 7, 2026Jiahao Shi, Edward Tsien, Yifeng Di +10Model VulnerabilitiesExploitation

  9. BAITBENCH: Measuring Agent Reward Hacking with Optional Shortcuts Planted in ML Tasks

    Aug 31, 2026Pradyumna Shyama Prasad, Meiri Anto, Leon Eshuijs +3Agentic BenchmarksExploitation

  10. LLM-Assisted Dynamic Threat Analysis for Attacker-Reachable Software Weaknesses in Autonomous Vehicles

    Aug 13, 2026Md Wasiul Haque, Sagar Dasgupta, Mizanur Rahman +1Program AnalysisExploitation

  11. Mechanism Design for Generative Engines: From Exploitation toward Win-Win Outcomes

    Aug 11, 2026Chen Xu, Zitian Guo, Chenyan XiongIncentivesCitations

  12. Quality-Diversity Stress Tests for Process Reward Models:What Archive Coverage Can and Cannot Certify

    Aug 8, 2026Ibne Farabi Shihab, Fariya AfrinProcess Reward ModelStress Testing

  13. SafeDivertor: Faithful Divertor Heat Flux Reconstruction from Macroscopic Plasma State Signals via Time-Frequency Prior Exploitation

    Aug 6, 2026Hao Si, Zehua Chen, Qingquan Yang +8Heat DiffusionExploitation

  14. SkillHEX: Improving Agent Skills via Hypothesis-Driven Autonomous Exploration and Exploitation

    Aug 6, 2026Yuru Feng, Yaoqi Chen, Beidi Zhao +7Self-Evolving Skill LibrariesSkills

  15. The Disruptive Impact of Large Language Models on Capture the Flag Competitions and the Path Toward Fair Play

    Jul 28, 2026Michael Macaulay, Harmony Bouabid, Guo Gen Ang +1Large Language Model SafetyCybersecurity

  16. Do Agent Benchmarks Measure Capability? Protocol Validity in the Age of Agentic AI

    Jul 24, 2026Jiaqi Shao, Hanck Chen, Wei Zhang +2Agentic BenchmarksExploitation

  17. Demystifying On-Policy Distillation: Roles, Pathologies, and Regulations

    Jul 15, 2026Rui Wang, Hongru Wang, Yi Chen +4TeacherExploration

  18. When Agents Lie: Premeditation, Persistence, and Exploitation in Repeated Games

    Jul 6, 2026Jerick Shi, Terry Jingcheng Zhang, Bernhard Schölkopf +2Autonomous AgentsDeliberation

  19. Agent Reinforcement Learning via Pivotal-Aware Self-Feedback Retry

    Jul 4, 2026Weiyang Guo, Zesheng Shi, Longhui Zhang +3RetryingOffline Reinforcement Learning

  20. Safety Targeted Embedding Exploit via Refinement

    Jul 2, 2026Joshua Adrian CahyonoMultilingual SafetyLarge Language Model Safety

  21. CyberChainBench: Can AI Agents Secure Smart Contracts Against Real-World On-Chain Vulnerabilities?

    Jun 24, 2026Jintao Huang, Fengqing Jiang, Radha Poovendran +1Smart ContractsModel Vulnerabilities

  22. Decoupling Reconnaissance and Exploitation: Measuring the Capability Boundaries of LLM-Based Web Penetration Testing

    Jun 24, 2026Liwei Yu, Shuo Li, Ming Zhou +2Penetration TestingExploitation

  23. Execution-bound advisory automation for agentic AI: a reproducible AIBOM-driven CSAF-VEX framework

    Jun 16, 2026Petar Radanliev, Omar Santos, Carsten Maple +1Security EvaluationRuntime Enforcement

  24. Data-Centric Benchmarking of Exploit Generation in LLMs: Understanding the Impact of Fine-Tuning

    Jun 13, 2026Yiwei Chen, Lichi Li, Kai Cheung +2Model VulnerabilitiesExploitation

  25. Cheap Reward Hacking Detection

    Jun 8, 2026Iván Belenky, Joaquín Itria, Steven JohnsExploitation

  26. VATS: Exploiting Implicit Authority in Error-Path Injection via Systematic Mutation

    Jun 6, 2026Harshil Patel, Kunal PaiModel Context ProtocolExploitation

  27. Medication-Aware Financial Exploitation Detection for Alzheimer's Patients Using Edge-Aware Interaction Risk Modeling

    May 30, 2026Farzana Akter, Lisan Al Amin, Rakib Hossain +2AlzheimerMedication Leaflet

  28. When Safe Skills Collide: Measuring Compositional Risk in Agent Skill Ecosystems

    May 30, 2026Su Wang, Pin Qian, Yihang Chen +6SkillsExploitation

  29. unix-ctf: Procedural Environments for Unix-Competence Reinforcement Learning

    May 27, 2026Geoffrey Bradway, Roger Creus Castanyer, Lorenz Wolf +3RobotwinExploitation

  30. Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models

    May 24, 2026Wenlong Deng, Jiaji Huang, Kaan Ozkara +4Reward GradientsExploitation

  31. Real-Time Auto-Optimization in Unknown Environments via Structure-Exploiting Dual Control for Exploration and Exploitation

    May 21, 2026Shiying Dong, Haoyang Yang, Qiwei Liu +1Optimal ControlOptimization Modeling

  32. Hack-Verifiable Environments: Towards Evaluating Reward Hacking at Scale

    May 20, 2026Amit Roth, Ankur Samanta, Matan Halevy +2Adversarial EvaluationExploitation

  33. When Efficiency Backfires: Cascading LLMs Trigger Cascade Failure under Adversarial Attack

    May 17, 2026Zehan Sun, Dingfan Chen, Songze LiAttacker Large Language ModelLarge Language Models Fail

  34. Imperfect World Models are Exploitable

    May 15, 2026Logan Mondal Bhamidipaty, Esmeralda S. Whitammer, David Abel +2ExploitationWorld Models

  35. ExploitBench: A Capability Ladder Benchmark for LLM Cybersecurity Agents

    May 13, 2026Seunghyun Lee, David BrumleyExploitationVulnerable Code

  36. Exploiting Pre-trained Encoder-Decoder Transformers for Sequence-to-Sequence Constituent Parsing

    May 13, 2026Daniel Fernández-González, Cristina Outeiriño CidTransformer EncoderSequence Modeling

  37. Comment and Control: Hijacking Agentic Workflows via Context-Grounded Evolution

    May 11, 2026Neil Fendley, Zhengyu Liu, Aonan Guan +2Agentic WorkflowsHijacking

  38. ExploitGym: Can AI Agents Turn Security Vulnerabilities into Real Attacks?

    May 11, 2026Zhun Wang, Nico Schiller, Hongwei Li +13ExploitationVulnerable Code

  39. Strategic Exploitation in LLM Agent Markets: A Simulation Framework for E-Commerce Trust

    May 11, 2026Shijun Lei, Quang Nguyen, Swapneel S Mehta +7Multi-Agent SimulationsPersonalized Large Language Model Agents

  40. Exploitation Without Deception: Dark Triad Feature Steering Reveals Separable Antisocial Circuits in Language Models

    May 10, 2026Cameron Berg, Roshni LullaDeceptionLarge Language Model Bias

  41. Position: AI Security Policy Should Target Systems, Not Models

    May 10, 2026Michael A. Riegler, Inga StrümkeExploitationArtificial Intelligence Risk

  42. AlphaExploitem: Going Beyond the Nash Equilibrium in Poker by Learning to Exploit Suboptimal Play

    May 9, 2026Vlad Murgoci, Matthijs Spaan, Yaniv OrenPokerImperfect-Information Games

  43. Drain-Vortex Optimization: A Population-Based Metaheuristic Inspired by Multi-Drain Free-Vortex Flow

    May 9, 2026Mohsen Omidi, Brian VaughanMetaheuristicsBasin

  44. Asymmetric On-Policy Distillation: Bridging Exploitation and Imitation at the Token Level

    May 7, 2026Nan Jia, Haojin Yang, Xing Ma +6Efficient On-Policy DistillationPolicy Gradient

  45. MOSAIC-Bench: Measuring Compositional Vulnerability Induction in Coding Agents

    May 5, 2026Jonathan Steinberg, Oren GalVulnerable CodeCoding Agents

  46. APIOT: Autonomous Vulnerability Management Across Bare-Metal Industrial OT Networks

    May 4, 2026Adel ElZemity, Budi Arief, Shujun Li +6Penetration TestingRemediation

  47. Towards Understanding Specification Gaming in Reasoning Models

    May 4, 2026Kei Nishimura-Gasparian, Robert McCarthy, David LindnerLarge Reasoning ModelsLarge Language Model Agents