LLM Auditing

LLM: Large Language Model

Momentum

59 papers in the last four weeks, up 79% on the four weeks before. 0.6% of all new papers.

Jul 13Week of Sep 28

Latest papers 453

All topics
CardsList
  1. Where LLM Graders Succeed and Break: Evidence from Two Computer-Science Exams

    Sep 24, 2026Ali Habibullah, Yazan Alshoibi, Mohammad Alshiekh +2Prompt SensitivityLLM-as-a-Judge

  2. Claim-Gated Source-Risk Auditing for Generative Search

    Sep 24, 2026Kainan Zhou, Chuhong Xu, Gangzhen Qian +1Data ProvenanceLLM Auditing

  3. How Sensitive Are LLM Leaderboard Claims to Hidden Model Selection?

    Sep 23, 2026Chen Yang, Xianyang Zhang, Jun ChenLLM EvaluationSelective Inference

  4. Can LLMs Catch a Rigged Backtest? A Clean-Control Calibration Benchmark

    Sep 23, 2026Makar Ulesov, Vladislav Smirnov, Omar Ibrahim +1Benchmark AuditingLLM Auditing

  5. How Much Were You Told? Measuring External Information in Peer Reviews

    Sep 23, 2026Matthieu Dubois, Pablo Piantanida, François YvonAI-Generated Text DetectionLLM Auditing

  6. EADC: Evaluation of Advanced and Deep-level Compliance in Large Language Models

    Sep 22, 2026Yan Zhang, Ruien Li, Yaoyao Peng +4LLM Safety BenchmarksLLM Evaluation

  7. FineWeb-CLaR: Culture, Language, and Region Annotations for Benchmark-Aligned Corpus Auditing

    Sep 21, 2026Yusser Al Ghussin, Eva Gavaller, Cristina España-Bonet +2Multilingual Language Model EvaluationLLM Auditing

  8. Fingerprinting Multimodal Large Language Models

    Sep 17, 2026Chao Huang, Meng Tong, Kejiang ChenLLM AuditingLanguage Model Fingerprinting

  9. Trust, but Validate the Instrument: Auditing AI-Generated RTL Verification Plans on Authored Security-Regression Proxies

    Sep 17, 2026Hang Xiao, Chuhong Xu, Kainan Zhou +2Formal Hardware VerificationLLM Auditing

  10. AUDITPLAN: Commit, Then Answer for Auditable Safety Alignment

    Sep 16, 2026Sai Sri Pushpa Jampani, Kshitij Mishra, Asif EkbalLLM AlignmentLLM Auditing

  11. Monitoring and Discovering Reward Hacking with Internal Representations during LLM Evaluations

    Sep 16, 2026Leon Bergen, Usha Bhalla, Andrew Lee +15Reward HackingLLM Evaluation

  12. Beyond Accuracy: How Procedural Traces Shift the Decision Criterion of LLM Overseers

    Sep 16, 2026Zihan Chen, Di Zhu, Lei Zheng +1LLM-as-a-JudgeLLM Auditing

  13. OPEN-1B: A Fully Auditable Training Run

    Sep 15, 2026John Donaghy, Brian Wilcox, Oğuzhan Ersoy +6Neural Network VerificationLLM Auditing

  14. Challenges of Auditing: Variability in Outputs of Large Language Models for Health

    Sep 15, 2026Yuan Pu, Yewon Chang, Furong Jia +4LLM EvaluationLLM Auditing

  15. PRISMA-LLM: An Empirical Reporting Framework for AI-Assisted Systematic Reviews

    Sep 14, 2026Miguel Zabaleta, Baihan LinLLM AuditingAI-Assisted Scientific Research

  16. A decision-basis contract for auditable LLM-assisted medical billing verification: deterministic rules, verbatim evidence, and fail-closed abstention

    Sep 14, 2026Jan Hölter, Kevin Geis, Benjamin Raab +1LLM Answer VerificationLLM Auditing

  17. LLMs as Post-hoc Auditors of Physiological Plausibility in Symbolic Regression: A Clinician-Evaluated Case Study

    Sep 12, 2026Jorge López-Varela, J. Ignacio Hidalgo, José-Manuel Muñoz +6LLM AuditingExplainability Evaluation

  18. Auditable Emergency Triage for Maternal and Newborn Care in India

    Sep 10, 2026Shobhit Jagga, Aman Dalmia, Niharika Priyadarshini +7HealthcareLLM Auditing