LLM Auditing

LLM: Large Language Model

Momentum

59 papers in the last four weeks, up 79% on the four weeks before. 0.6% of all new papers.

Jul 13Week of Sep 28

Latest papers 453

All topics
CardsList
  1. Causal Stories from Sensor Traces: Auditing Epistemic Overreach in LLM-Generated Personal Sensing Explanations

    May 9, 2026Shanshan Zhu, Han Zhang, J. Doris Chi +2LLM GroundingLLM Auditing

  2. LLM hallucinations in the wild: Large-scale evidence from non-existent citations

    May 8, 2026Zhenyue Zhao, Yihe Wang, Toby Stuart +3LLM AuditingLLM Hallucination Detection

  3. MAVEN: Multi-Agent Verification-Elaboration Network with In-Step Epistemic Auditing

    May 8, 2026Yinsheng Yao, Jiehao Tang, Zhaozhen Yang +1LLM AuditingMulti-Agent Debate

  4. LLMs are not (consistently) Bayesian: Quantifying internal (in)consistencies of LLMs' probabilistic beliefs

    May 7, 2026Chacha Chen, Matthew Jörke, Adam Goliński +4Belief RevisionLLM Auditing

  5. Dataset Watermarking for Closed LLMs with Provable Detection

    May 7, 2026Pengrun Huang, Kamalika Chaudhuri, Yu-Xiang WangDataset WatermarkingLLM Auditing

  6. When No Benchmark Exists: Validating Comparative LLM Safety Scoring Without Ground-Truth Labels

    May 7, 2026Sushant Gautam, Finn Schwall, Annika Willoch Olstad +6LLM Safety BenchmarksLLM Evaluation

  7. DataDignity: Training Data Attribution for Large Language Models

    May 7, 2026Xiaomin Li, Andrzej Banburski-Fahey, Jaron LanierLLM AuditingInformation Retrieval

  8. Automatically Finding and Validating Unexpected Side-Effects of Interventions on Language Models

    May 6, 2026Quintin Pope, Ajay Hayagreeve Balaji, Jacques Thibodeau +1Language Model Generation EvaluationLLM Auditing

  9. Distilling Bayesian Belief States into Language Models for Auditable Negotiation

    May 6, 2026Zongqi Cui, Baihan LinMulti-Agent NegotiationOpponent Modeling

  10. Deployment-Relevant Alignment Cannot Be Inferred from Model-Level Evaluation Alone

    May 6, 2026Varad Vishwarupe, Nigel Shadbolt, Marina Jirotka +1LLM EvaluationLLM Alignment

  11. Frontier Lag: A Bibliometric Audit of Capability Misrepresentation in Academic AI Evaluation

    May 5, 2026David Gringras, Misha SalahshoorLLM EvaluationLLM Auditing

  12. AI-Generated Smells: An Analysis of Code and Architecture in LLM and Agent-Driven Development

    May 4, 2026Yuecai Zhu, Nikolaos Tsantalis, Peter C. RigbySoftware EngineeringLLM Auditing

  13. Auditing demographic bias in AI-based emergency police dispatch: a cross-lingual evaluation of eleven large language models

    May 2, 2026William Guey, Wei Zhang, Pierrick Bougault +4Multilingual Language Model EvaluationLLM Auditing

  14. When RAG Chatbots Expose Their Backend: An Anonymized Case Study of Privacy and Security Risks in Patient-Facing Medical AI

    May 1, 2026Alfredo Madrid-García, Miguel RujasHealthcareLLM Auditing

  15. Test Before You Deploy: Governing Updates in the LLM Supply Chain

    Apr 30, 2026Mohd Sameen Chishti, Damilare Peter Oyinloye, Jingyue LiLLM EvaluationLLM Auditing

  16. TRUST: A Framework for Decentralized AI Service v.0.1

    Apr 29, 2026Yu-Chao Huang, Zhen Tan, Mohan Zhang +3AI Agent ReliabilityAI Accountability

  17. Persuadability and LLMs as Legal Decision Tools

    Apr 29, 2026Oisin Suttle, David LillisLLM AuditingLLM Decision-Making

  18. Bye Bye Perspective API: Lessons for Building and Governing Measurement Infrastructure

    Apr 28, 2026David Hartmann, Manuel Tonneau, Angelie Kraft +7LLM EvaluationLLM Auditing

  19. Authority Inversion in LLM-Mediated Ubiquitous Systems: When Models Trust Users Over Sensors

    Apr 28, 2026Long Zhang, Zi-bo Qin, Wei-neng ChenKnowledge Conflicts in Language ModelsLLM Auditing

  20. Making AI-Assisted Grant Evaluation Auditable without Exposing the Model

    Apr 28, 2026Kemal BicakciLLM AuditingPrivacy-Preserving ML

  21. Evaluating whether AI models would sabotage AI safety research

    Apr 27, 2026Robert Kirk, Alexandra Souly, Kai Fronsdal +2Language Model Safety EvaluationLLM Auditing

  22. A Multi-Dimensional Audit of Politically Aligned Large Language Models

    Apr 27, 2026Lisa Korver, Mohamed Mostagir, Sherief RedaLLM AuditingPolitical Bias in Language Models

  23. One Size Fits None: Heuristic Collapse in LLM Investment Advice

    Apr 26, 2026Jillian Ross, Andrew W. LoFinancial ServicesLLM Auditing