LLM Auditing

LLM: Large Language Model

Momentum

59 papers in the last four weeks, up 79% on the four weeks before. 0.6% of all new papers.

Jul 13Week of Sep 28

Latest papers 453

All topics
CardsList
  1. GANDR: Claim Auditing for Verifiable Legal Answer Generation

    Sep 9, 2026Chen Qian, Yimeng Wang, Yu Chen +2LLM Answer VerificationLegal Citation Verification

  2. Reference-Based Bias Detection in LLMs via Relative Representations of Hidden States

    Sep 9, 2026Marek Jeliński, Jan Dubiński, Maciej Chrabaszcz +1LLM AuditingSocial Bias in Language Models

  3. Benchmark Scores Are Pipeline-Dependent: A Reliability Audit of Cybersecurity LLM Benchmarks

    Sep 8, 2026Aymene Berriche, Cathrine Shalby, Mohannad Alhanahnah +1LLM EvaluationLLM Auditing

  4. Measuring Brand and Source Discovery under Repeated LLM Queries: A Finite-Sample Audit

    Sep 4, 2026Dmitrij ŻatuchinLLM AuditingLLM Information Extraction

  5. The Dice Roll Method: A Standardized Protocol for Repeated-Query Auditing of Large Language Model Brand Recommendations

    Sep 3, 2026Dmitrij ŻatuchinLLM AuditingLLM Reliability

  6. The Analyst in the Prompt: Role, Retrieval, and Memory Biases in LLM Financial Analysis

    Sep 2, 2026Ahmed Asaad, Amr Mohamed, Yang Zhang +1LLM EvaluationLLM Auditing

  7. Measuring consistency via ensemble margin and local prediction variability: Auditing decision systems in the presence of predictive multiplicity

    Sep 1, 2026Sinjini Banerjee, Tim Marrinan, Anand D. SarwateSelective PredictionEnsemble Learning

  8. LLMPEDIA: Browsing, Verifying, and Comparing the Parametric Encyclopedic Knowledge of LLMs

    Sep 1, 2026Muhammed Saeed, Simon RazniewskiLLM EvaluationLLM Auditing

  9. Context-Grounding Gains Are Mediated by Pre-existing Machinery: Auditing GRPO, SFT, and DPO

    Sep 1, 2026Prakhar Gupta, Vaibhav GuptaRL for Language ModelsLLM Grounding

  10. Value Over Language Model: Detecting Original Contribution in Writing

    Sep 1, 2026Vibhhu Sharma, Thorsten Joachims, Sarah DeanLLM EvaluationAI-Generated Text Detection

  11. Validity-Aware Jailbreak Evaluation for Large Language Models

    Aug 31, 2026Qilong Wu, Sahil Wadhwa, Pranab Mohanty +2Language Model Safety EvaluationLLM Auditing

  12. Sources of Truth: A Multi-Platform, Multilingual Audit of Citations in AI Mental Health Information Queries

    Aug 31, 2026Phuong Anh Nguyen, Jill Noorily, Matthew Flathers +7LLM EvaluationLLM Auditing

  13. DIASENTINEL: An Auditable Multi-Agent System for Guideline-Grounded Diabetes Risk Screening

    Aug 31, 2026Yung Wei Shueh, Zhi-Jie Chen, Chia-Hsuan Hsu +9Multi-Agent LLM SystemsMedical Report Generation

  14. Auditing MCQA Benchmarks through Probability Landscapes

    Aug 31, 2026Minsoo Song, Chanjun ParkBenchmark AuditingLLM Auditing

  15. On the Recoverability of Private Information Unlearning in Large Language Models

    Aug 30, 2026Shicheng Hu, Runzhi Tian, Ziqiao Wang +1LLM AuditingPrivacy Leakage in Language Models

  16. Chain-of-Thought Faithfulness of Reasoning Models Varies with Where and How Preference Cues Are Delivered

    Aug 29, 2026Aryo Pradipta Gema, Neel Rajani, Rohit Saxena +2CoT FaithfulnessLLM Auditing

  17. Validating FKG.in: Soundness Assessment in LLM-Augmented Indian Food Knowledge

    Aug 29, 2026Saransh Kumar Gupta, Armaan Shah, Lipika Dey +2LLM AuditingLLM Reliability

  18. Not to Break, but to Attest: Adversarial Probes for Privacy-Preserving LLM Verification

    Aug 28, 2026Cameron Wilding, Mina Shaker, Fatemeh GanjiLLM AuditingPrivacy-Preserving ML

  19. Difference-in-Differences on a Censored Rating Scale Can Manufacture an Effect: Evidence from a Pre-Registered LLM-Judge Audit

    Aug 27, 2026Shuyi Fan, Boyuan Deng, Mengyu Xu +3Causal InferenceLLM Auditing

  20. The "Curse of Knowledge" in LLM Query Simulation: Concept Provenance for Tracing Answer-Side Intrusion

    Aug 26, 2026Chenglong Ma, Xinye Wanyan, Danula Hettiachchi +2LLM AuditingIR Evaluation

  21. The Mask Is Not the Model: Auditing Prefix Invariance in Attention, State-Space, and Hybrid Sequence Models

    Aug 24, 2026Taebong Kim, Youngsik Hong, Minsik Kim +3LLM AuditingSequence Modeling