AI Agent Auditing

Latest papers 100

All topics
CardsList
  1. ReplayLens: Auditing Agents' Use of Outcomes

    Sep 28, 2026Dong Xu, Zhangfan Yang, Jiantao Wu +5AI Agent AuditingLLM Agent Memory

  2. Opera: A Verbal Critic Framework for Long-horizon Coding Agents

    Sep 27, 2026Kai Mei, Zhiyuan Hu, Yutong Dai +7AI Coding AgentsAI Agent Auditing

  3. Learning Strategies to Break Judges

    Sep 27, 2026Guruprerana Shabadi, Aaditya Naik, Rajeev Alur +1LLM-as-a-JudgeAI Agent Auditing

  4. LLM Agents Can Easily Tamper With Their Own Traces

    Sep 24, 2026Jeremy Qin, David Schmotz, Derck Prinzhorn +3AI Agent AuditingAI Agent Security

  5. Reward Hacking Challenges Oversight of Autonomous Research Agents

    Sep 23, 2026Yue Huang, Zhangchen Xu, Yuchen Ma +12Reward HackingAI Agent Auditing

  6. Discover, Falsify, Revise: Auditing Input-Use Claims from Source Code to Predictive Contribution in Agent-Discovered Cell Models

    Sep 23, 2026Mengran Li, Bo Li, Chengyang Zhang +3AI Agents for Scientific DiscoveryAI Agent Auditing

  7. The Disciplinary Language Transfer Problem: How Psychological Vocabulary Produces Governance Failures in AI Agent Deployment

    Sep 22, 2026Kymberly Lasser-Chere, Tyler Akidau, Marc MillstoneAI AccountabilityAI Agent Auditing

  8. PACT: Can Enterprise AI Assistants Be Trusted Under Pressure?

    Sep 16, 2026Mika Okamoto, Ansel Kaplan ErolAI Agent AuditingLLM Agent Evaluation

  9. Who Audits Whom, on What Substrate, with What Evidence? An Independence-Graded Audit Protocol for Agentic AI

    Sep 16, 2026Mohamed Chahine GhanemAI AssuranceAI Agent Auditing

  10. HazardAuditor: From Executable Threats to Safer Computer-Use Agents

    Sep 14, 2026Yunhao Feng, Ruixiao Lin, Ming Wen +5Language Model Safety EvaluationAI Agent Auditing

  11. Scores Alone Do Not Prove Discovery: The Discovery Certification Protocol for Auditing AI Research Agents

    Sep 7, 2026Jingjie Ning, Shanshan Zhong, Xiaochuan Li +1AI Agents for Scientific DiscoveryAlgorithmic Auditing

  12. DNative-Twin: Decision Graphs and Digital Twins for Reconstructable Agentic Decisions

    Sep 3, 2026Junjie Pang, Zhenzhen Xie, Haoke Han +3Data ProvenanceAI Agent Auditing

  13. Agent Flight Recorder: Tamper-Evident Audit Trails with On-Chain Anchoring for Long-Horizon Tool-Using Agents

    Sep 1, 2026Laurent Bindschaedler, Quentin Botha, Christoph SiebenbrunnerData ProvenanceAlgorithmic Auditing

  14. CatchBench: When Can an Agent Failure Be Caught?

    Aug 24, 2026Yue Zhao, Mengyuan Li, Ruolin Li +5Agent Failure AnalysisBenchmark Auditing

  15. A2EA^2E : An End-to-End Agent Auditing Engine

    Aug 7, 2026Haoning Wang, Mingxun Zhang, Chenyue Yu +4Tool-Use EvaluationAI Agent Auditing

  16. SearchAuditor: Auditing and Attributing Failures in Long-Horizon Search Agents

    Aug 5, 2026Zhixiang Liang, Yifei Liu, Yidan Huang +5Agent Failure AnalysisAI Agent Reliability

  17. SkillTrace: Multi-Trace Provenance Auditing for LLM-Agent Skill Reuse

    Aug 5, 2026Jialuo Chen, Minghe Wang, Lingqi Jiang +7Data ProvenanceAI Agent Auditing