AI Agent Auditing

Latest papers 100

All topics
CardsList
  1. Coding Agents as Test-Suite Auditors: Finding What Official Suites Miss While Approaching What They Catch

    Aug 3, 2026Shuyang Xie, Shuxiao Xie, Feng Zhu +2Automated Software TestingBenchmark Auditing

  2. Auditing Discovery Claims: A Two-Sided Criterion for Agentic Science, with the Negative Side Decidable

    Aug 2, 2026Wenhui Chen, Jianlin Chen, Ziyao Lin +1Reward HackingAI for Science

  3. One Human, NN Agents: Audit-Budget Allocation for LLM Agent Fleets under Miscalibrated, Correlated Confidence

    Jul 30, 2026Cesare Zavattari, Alessandro Tommasi, Giuseppe PrencipeScalable OversightAI Agent Reliability

  4. Auditing Emergent LLM-Agent Collaboration through Cooperation-Obligation Coupling

    Jul 29, 2026Zuyuan Zhang, Hanqing Yang, Carlee Joe-Wong +1Multi-Agent LLM SystemsAI Agent Auditing

  5. Success Is Not Self-Explanatory: Auditing Success Provenance in Agent Evaluation

    Jul 27, 2026Jingkun Luo, Da-Tian PengData ProvenanceBenchmark Auditing

  6. Do Agent Benchmarks Measure Capability? Protocol Validity in the Age of Agentic AI

    Jul 24, 2026Jiaqi Shao, Hanck Chen, Wei Zhang +2Computer-Use Agent BenchmarksReward Hacking

  7. Automated Textbook Auditing with Multi-Agent LLM Systems

    Jul 13, 2026Ciprian Cristescu, Adrian-Marius Dumitran, Angela-Liliana Dumitran +1AI Agent AuditingGenerative AI in Education

  8. ANCHOR: Automated Alignment Auditing for CLI Agents on Real-World Harm

    Jul 11, 2026Kefan Song, Yanjun QiAI Agent AuditingLLM Auditing

  9. SkillAudit: From Fixed-Suite Benchmarking to Skill-Centered Assessment

    Jun 21, 2026Dexu Yu, Youhua Li, Zhaoyang Guan +12AI Agent AuditingAutomated Evaluation

  10. AgentRiskBOM: A Risk-Scoping Security Bill of Materials for Agentic AI Systems

    Jun 20, 2026Srimonti Dutta, Akshata Kishore MoharirAI Risk ManagementAI Agent Auditing

  11. Local LLM Agents as Vulnerable Runtimes:A Source-Code Audit of the Agent Runtime Layer

    Jun 19, 2026Zhengsong Zhang, Zongze Li, Jiawei Guo +1AI Agent AuditingSoftware Vulnerability Detection

  12. PI-Hunter: Automated Red-Teaming for Exposing and Localizing Prompt Injections

    Jun 10, 2026Pengfei He, Lesly Miculicich, Vishesh Sharma +5AI Agent AuditingLLM Auditing

  13. The Arbiter Agent: Continually Monitoring Multi-Agent Conversations to Detect Emergent Misalignment

    Jun 9, 2026Filippo Tonini, Federico Torrielli, Anton Danholt Lautrup +3AI Agent AuditingLLM Auditing

  14. PrivacyPeek: Auditing What LLM-Based Agents Acquire, Not Just What They Say

    May 29, 2026Mingxuan Zhang, Jiahui Han, Dadi Guo +5Data LeakagePrivacy Auditing

  15. Gram: Assessing sabotage propensities via automated alignment auditing

    May 28, 2026David Lindner, Victoria Krakovna, Sebastian FarquharAI Coding AgentsAI Agent Auditing

  16. AgentAtlas: Beyond Outcome Leaderboards for LLM Agents

    May 19, 2026Parsa Mazaheri, Kasra MazaheriAgent Failure AnalysisComputer-Use Agent Benchmarks

  17. Auditing Agent Harness Safety

    May 14, 2026Chengzhi Liu, Yichen Guo, Yepeng Liu +8AI Agent AuditingLLM Auditing