Black-Box Model Auditing

Momentum

12 papers in the last four weeks, up 100% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 66

All topics
CardsList
  1. Agent Step Value: Auditing Evaluator-Channel Reversals in Black-Box Agent Traces

    Jul 5, 2026Andrew Zhang, Chengzhan LiLLM Agent EvaluationAI Agent Evaluation

  2. Aionoscope: Debugging Latent-State Accessibility in Time-Series Representations

    Jul 1, 2026Alexander Chemeris, Ming Jin, Randall BalestrieroSynthetic Benchmark GenerationTime Series Representation Learning

  3. Using AI Agents to Automate Black-Box Audits of Personalization Algorithms at Scale

    Jun 29, 2026Alessandro Morosini, Sarah H. Cen, Andrew Ilyas +3Algorithmic AuditingAlgorithmic Bias

  4. Sequential Fairness Auditing with Limited Output Access

    Jun 29, 2026Ioannis Pitsiorlas, Martha V. Sourla, Marios KountourisAlgorithmic FairnessGroup Fairness

  5. RECAST: Model Reconstruction via Counterfactual-Aware Wasserstein Geometry under Limited Data

    Jun 26, 2026Xuan Zhao, Lena Krieger, Zhuo Cao +3Surrogate ModelingModel Extraction Attacks

  6. Where Black-box Drug-Target Interaction Prediction Models Look: Cross-Method Explainability

    Jun 12, 2026Ali Vefghi, Zahed Rahmati, Mohammad AkbariFeature AttributionExplainability Evaluation

  7. A prior-free blind detection of information leakage from model predictions

    Jun 9, 2026Laurence A. JacobsData LeakageBlack-Box Model Auditing

  8. Auditing Proprietary Alignment in Large Language Models: A Comparative Framework Without a Ground-Truth Standard

    Jun 7, 2026Alireza Arbabi, Florian KerschbaumLLM AlignmentLLM Auditing

  9. MC-PDD: Masked Corpus-Level Pretraining Data Detection for Black-Box Large Language Models

    Jun 6, 2026Kaixin Lan, Mu You, Tao Fang +3Membership Inference AttacksLLM Auditing

  10. Is My Vision-Language Data in Your AI? Membership Inference Test (MINT) Demo 2

    Jun 5, 2026Daniel DeAlcala, Gonzalo Mancera, Julian Fierrez +3Membership Inference AttacksPrivacy Leakage in Language Models

  11. Auditing Near-Optimal Policies Can Be Exponentially Hard: Conditional Query Lower Bounds via Occupancy Rashomon Capacity

    May 29, 2026Ibne Farabi Shihab, Sanjeda Akter, Anuj SharmaInformation-Theoretic Lower BoundsBlack-Box Model Auditing

  12. Token Inflation: How Dishonest Providers Can Overcharge for Large Language Model Usage

    May 28, 2026Shahinul Hoque, Jinghuai Zhang, Jinyuan Sun +1LLM AuditingBlack-Box Model Auditing

  13. Auditing Training Data in Generative Music Models via Black-Box Membership Inference

    May 28, 2026Yi Chen Liu, Jiawei Yu, Kexin Cao +3Text-to-Music GenerationMembership Inference Attacks

  14. Symmetry Defeats Auditing

    May 27, 2026Nick Merrill, Zeke MedleyAlgorithmic AuditingAdversarial Attacks

  15. Auditing and Fixing Economic Validity in Tabular Foundation Models for Discrete Choice

    May 26, 2026Yingshuo Wang, Xian Sun, Yanhang Li +2Tabular Foundation ModelsDiscrete Choice Modeling

  16. Unlocking Apple's Private Cloud Compute: An Analysis of Privacy-Preserving Artificial Intelligence

    May 22, 2026Yannik Dittmar, Marvin Jerome Stephan, Thomas Völkl +2Privacy AuditingPrivacy-Preserving Language Models

  17. Optimal Guarantees for Auditing Rényi Differentially Private Machine Learning

    May 21, 2026Benjamin D. Kim, Lav R. Varshney, Daniel AlabiPrivacy AuditingBlack-Box Model Auditing

  18. I-SAFE: Wasserstein Coherence Metrics for Structural Auditing of Scientific AI Models

    May 20, 2026Barbara Tarantino, Gennaro Auricchio, Paolo GiudiciAlgorithmic AuditingBlack-Box Model Auditing

  19. How Do Document Parsers Break? Auditing Structural Vulnerability in Document Intelligence

    May 19, 2026Yue Chen, Yihao Wang, Ziyi Tang +2Document ParsingDocument Layout Analysis

  20. Architecture-Aware Explanation Auditing for Industrial Visual Inspection

    May 14, 2026Sibo Jia, Zihang Zhao, Kunrong LiIndustrial InspectionExplainability Evaluation

  21. Beyond the Wrapper: Identifying Artifact Reliance in Static Malware Classifiers using TRUSTEE

    May 7, 2026Riyazuddin Mohammed, Lan ZhangMalware ClassificationMalware Analysis

  22. ISAAC: Auditing Causal Reasoning in Deep Models for Drug-Target Interaction

    May 3, 2026Barbara Tarantino, Sun Kim, Yijingxiu Lu +1Reasoning EvaluationCausal Interpretability

  23. Bounding the Black Box: A Statistical Certification Framework for AI Risk Regulation

    Apr 23, 2026Natan Levy, Gadi PerlAI AssuranceAI Risk Management

  24. Behavioral Consistency and Transparency Analysis on Large Language Model API Gateways

    Apr 22, 2026Guanjie Lin, Yinxin Wan, Shichao Pei +3LLM AuditingBlack-Box Model Auditing

  25. Identifying Ethical Biases in Action Recognition Models

    Apr 20, 2026Ana Baltaretu, Pascal Benschop, Jan van GemertHuman Activity RecognitionAlgorithmic Fairness