LLM Auditing

LLM: Large Language Model

Momentum

59 papers in the last four weeks, up 79% on the four weeks before. 0.6% of all new papers.

Jul 13Week of Sep 28

Latest papers 453

All topics
CardsList
  1. A Human Audit of OpenAIs AI-Generated Mathematical Proofs

    Aug 3, 2026Mikołaj Sienicki, Krzysztof SienickiLLM AuditingHuman Oversight of AI

  2. RADAR: Rubric-Aware Dependency and Redundancy Analysis for LLM-as-Judge Evaluation

    Aug 3, 2026Divyansh Singh, Reza Davari, Afra MashhadiLLM-as-a-JudgeLLM Auditing

  3. Understanding Sparse Attention Selectivity in Long-Context Foundation Models via Counterfactual Evaluation

    Aug 3, 2026Xingyu Ren, Youran Sun, Chugang Yi +1LLM AuditingSparse Attention

  4. Judging Is Not Enumerating: Silent Omissions in LLM-Authored Acceptable Sets

    Aug 2, 2026Wenhui Chen, Jianlin Chen, Ziyao Lin +2LLM EvaluationLLM-as-a-Judge

  5. Auditable Release Control for Pedagogical Leakage in LLM Tutors

    Aug 1, 2026Nizam KadirLLM AuditingLLM Guardrails

  6. Benchmarks Are Not Monolithic: Sample-Level Auditing and Orchestration for LLM Evaluation

    Jul 30, 2026Philipp D. Siedler, Jordan SassoonLLM EvaluationBenchmark Auditing

  7. AISPA: User-Centric System Prompt Auditing for Large Language Model Applications

    Jul 30, 2026Xiangning Lin, Shenzhe Zhu, Shu Yang +23AI AccountabilityLLM Auditing

  8. One Human, NN Agents: Audit-Budget Allocation for LLM Agent Fleets under Miscalibrated, Correlated Confidence

    Jul 30, 2026Cesare Zavattari, Alessandro Tommasi, Giuseppe PrencipeScalable OversightAI Agent Reliability

  9. Auditing Emergent LLM-Agent Collaboration through Cooperation-Obligation Coupling

    Jul 29, 2026Zuyuan Zhang, Hanqing Yang, Carlee Joe-Wong +1Multi-Agent LLM SystemsAI Agent Auditing

  10. Do Latent Channels Actually Communicate? A Causal Audit of Latent Multi-Agent LLM

    Jul 29, 2026Huixiang Zhang, Mahzabeen EmuLLM AuditingCausal Interventions in Language Models

  11. TraceCoder: Explainable and Auditable Code Generation with Position-Key Snippet Versioning

    Jul 28, 2026Rwaida Alssadi, Muntaser Syed, Balaji Kasula +6Data ProvenanceLLM Auditing

  12. Forecasting Side Effects of Activation Steering

    Jul 28, 2026Chong Yong Ong, Alson Wei Jie Sim, Peixin Zhang +1Language Model SteeringLLM Auditing

  13. Task-Conditional Faithfulness Auditing of Multimodal LLMs for Grid Diagnosis

    Jul 27, 2026Tianqiao Zhao, Meng Yue, Jianhui WangLLM AuditingMultimodal Model Evaluation

  14. Auditing Alignment Controllability in LLMs via Political Axes

    Jul 26, 2026Bartol Bućan, Nikola Sočec, Sarah Isufi +5LLM AlignmentLanguage Model Steering

  15. Opaque Epistemic Mediation: How LLM Deployment Configurations Shape the Validation of Pseudo-Science

    Jul 24, 2026Davide Scarso, Hugo Noronha de Almeida, Joaquim PinaLLM EvaluationLLM Auditing

  16. Beyond Shapley: An Influence-Based Data Auditing Pipeline for LLM Alignment and Evaluation

    Jul 24, 2026Yunting Song, Matthew Watson, Peter Grabowski +1LLM Safety BenchmarksLLM Auditing

  17. Every Model Cheats: Prompt-Level Mitigation of Cheating on Offensive Cyber Tasks

    Jul 23, 2026Michael Kouremetis, Ads Dawson, Raja Sekhar Rao Dheekonda +1LLM AuditingDeception in Language Models

  18. Code Monitor Red Teaming for Public-Test-Passing Code

    Jul 23, 2026Junchi Liao, Jiawen Deng, Fuji RenLLM AuditingCode Generation Evaluation

  19. Auditing Evidence Use in Medical LLM Diagnosis

    Jul 23, 2026Junchi Liao, Jiawen Deng, Fuji RenLLM AuditingMedical Diagnosis