AI Agent Auditing

Latest papers 100

All topics
CardsList
  1. What Output-Only Review Cannot Verify: Study Contracts for Research Agents

    Oct 8, 2026Eitan Waks, Ben GlockerLLM Agent VerificationAI Agent Auditing

  2. Learning to Report Unsafe Tasks in a Multi-Agent Game

    Oct 6, 2026Avyay M. Casheekar, Hariganesh TangiralaAI Agent SafetyMulti-Agent Systems

  3. Transect: Retaining Observability for Long-Horizon LLM Agent Evaluations

    Oct 6, 2026Toby D. Pilditch, Konstantinos Voudouris, Alexandra Abbas +1LLM Agent EvaluationLong-Horizon Agent Evaluation

  4. Visual Orchestration Tax in Agentic VLM Pipelines: Auditing and Certifying Visual Evidence Reuse

    Oct 6, 2026Lingteng ZengVLM EvaluationAI Agent Auditing

  5. One Step at a Time: Trading LLM Autonomy for Process Predictability

    Oct 6, 2026Hans Schabert, Christoph PetersAI Agent AuditingBusiness Process Automation

  6. Auditable Claims about AI Agents

    Oct 5, 2026Yue Zhao, Jiate Li, Li Li +4AI AssuranceAI Accountability

  7. ANT: A Multi-Granularity Network Traffic Dataset and Benchmark for Agents Behavior Auditing

    Oct 5, 2026Fan Li, Xiangyu Gao, Zixuan Liu +4AI Agent AuditingAI Agent Security Benchmarks

  8. AgentPrivArena: Evaluating and Auditing Real-world AI Agent Privacy

    Oct 5, 2026Shouju Wang, Haopeng ZhangAI Agent AuditingLLM Agent Evaluation

  9. Correct Code, Broken Contributions? SWE-CC: Benchmarking Repository Policy Compliance for Coding Agents

    Oct 5, 2026Hai Dang Truong, Rayner Goh, Thanh Le-Cong +1AI Agent AuditingCoding Agents

  10. AgentSpy: Making AI Agent Behavior Observable

    Oct 5, 2026Christoph Bühler, Matteo Biagiola, Luca Di Grazia +1AI Agent ReliabilityAI Agent Auditing

  11. Measurement-First Auditing of Agentic Leaderboards: Contamination Susceptibility, Matched-Control Re-evaluation, and Scorer Validation

    Oct 5, 2026Dishu Yang, Qi Su, Hongbo Qin +1Benchmark AuditingAI Agent Auditing

  12. Topology-Conditioned Backdoors: Language Models That Insert Vulnerabilities When They Infer They Are in a Multi-Agent System

    Oct 5, 2026Keegan Wang, Anantika MannbyLLM Backdoor AttacksAI Agent Auditing

  13. Blocking at the Boundary: Auditing Long-Horizon Agents against Staged Prompt Injection

    Oct 4, 2026Jingkai Liu, Yufei Han, Xiaoting Lyu +2Prompt InjectionAI Agent Auditing

  14. SoK: Decentralized Agent Economic Infrastructure

    Oct 1, 2026Rui Sun, Xihan Xiong, Qin Wang +5AI Agent AuditingAgentic Workflows

  15. Auditing Web Agent Evaluation on WebArena-Lite: Human Review of Outcomes and Trajectories

    Oct 1, 2026Chengguang Gan, Zimeng He, Yoshihiro Tsujii +3AI Agent AuditingWeb Agent Benchmarks

  16. Auditing Action Settlement in LLM Agent Environments: Order, Progress, and Replay

    Oct 1, 2026Haotian Chen, Bowen Ye, Yuning Zhang +1Multi-Agent LLM SystemsAI Agent Auditing

  17. Beyond Final Accuracy: Auditing Communication in LLM Multi-Agent Systems

    Oct 1, 2026Shixuan Li, Wei Yang, Peiyu Zhang +3Multi-Agent LLM SystemsAI Agent Auditing

  18. Groundability, Not Scale Alone: When Weak Reviewers Can Audit Strong Coding Agents

    Oct 1, 2026Junyu Guo, Shangding Gu, Ming Jin +1AI Agent AuditingCode Generation Evaluation

  19. From Verification Failures to Reusable Guidance for Coding Agents

    Sep 30, 2026Yuqing Zhai, Xiaohong Chen, Lingming Zhang +2AI Agent AuditingCoding Agents

  20. Where the Evidence Lives: Auditing AI Companions' Self-Descriptions

    Sep 30, 2026Seiya Ikeda, Shin-nosuke IshikawaAI Agent AuditingAI Companions

  21. Where Scientific Search Agents Fail: Decision-Checkpoint Auditing of Exposure and Inspection Attempts

    Sep 29, 2026Hongmin Li, Wanli ZhaoAI Agent AuditingScientific QA

  22. A Competing-Hazards Systematization of Loss of Control in Autonomous Agents

    Sep 29, 2026Mohamed Aly BoukeAgent Failure AnalysisAI Agent Auditing