Two-Sample Testing

Momentum

9 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 71

All topics
CardsList
  1. Two-Sample Testing via Path-based Inference

    Oct 5, 2026Eshant English, Wei-Cheng Lai, Yanfeng Yang +3Two-Sample Testing

  2. The Price of Correlated Tests: How Strict Should a Model Release Gate Be?

    Oct 1, 2026Marco PollanenReleaseGating

  3. Always-On Experimentation

    Sep 30, 2026Ricardo J. Sandoval, David Arbour, Avi Feller +1Two-Sample TestingControlled Study

  4. ICMAPE: In-Context Multiagent Pure Exploration

    Sep 27, 2026Xinyi Hu, Alessio Russo, Aldo PacchianoMulti-Agent PlanningStochastic Exploration

  5. Augmented Hypothesis Testing with Persona-Based LLM Simulations

    Sep 21, 2026Ziyad Benomar, Aymen Al Marjani, Paul Missault +1Two-Sample TestingUser Simulation

  6. Probabilistic Modelling of Operational Design Domains, A New Approach for Testing AI Systems

    Sep 21, 2026Hans-Werner WiesbrockProbabilistic ModelOntology

  7. Predictive Likelihood Ratios for Language Model Watermark Detection

    Sep 14, 2026Li MaLarge Language Model WatermarksTwo-Sample Testing

  8. The Art of Hierarchical Competing Patterns: Gaussian Process Optimization of Hyphenation

    Sep 7, 2026Ondřej Sojka, Petr SojkaGeneral Grid Search FrameworkPrompt Optimization

  9. Deciding When to Switch: E-Processes for Adaptive Minimax Training for Generative Adversarial Nets

    Aug 10, 2026Hyunjoo Kim, Sicheng Wu, Agastya Venkatraman +2Generative Adversarial NetworkStable Test-Time Adaptation

  10. Fisher-R1: Training LLM Agents for Reliable Hypothesis Testing

    Aug 7, 2026Jiacheng Miao, Jin Mu, Guanhua Chen +1Two-Sample TestingLarge Language Model Agents

  11. Single Canonical Prompts Underestimate LLM Safety's Surface-Form Sensitivity

    Aug 1, 2026Yongxi Zhou, Junwei Yao, Yuanzhe Liu +4Large Language Model SafetyUnsafe

  12. FILLER: Feature Imputation via Latent Location Exploration and Retrieval

    Jul 25, 2026Santu Mondal, Chayan Maitra, Rajat K. DeImputationInpainting

  13. Zero-Flow Two-Sample Tests

    Jul 23, 2026Yakun Wang, Leyang Wang, Song Liu +1Two-Sample Testing

  14. Non-Asymptotic Best Policy Identification Guarantees in Online Reinforcement Learning

    Jul 19, 2026Joseph Lazzaro, Alessio Russo, Aldo PacchianoOptimal PoliciesMarkov Decision Processes

  15. Testing Distributions Against Bounded Distinguishers

    Jul 17, 2026Mark Bun, Rathin Desai, Renato Ferreira PintoIndistinguishabilityTwo-Sample Testing

  16. ASK-NN: An Asymmetric Nearest-Neighbor Test that detects Distribution Drifts in Natural Language

    Jul 17, 2026Sergey Zakharov, Rodion Oblovatny, Alexey ZaytsevLarge Language Model HallucinationMachine-Generated Text Detection

  17. Bet on Features: Anytime-Valid and Feature-Aware Auditing of Conditional Quantile Forecasters

    Jul 13, 2026Ivane Antonov, Sohom Mukherjee, Richard Pibernik +1Quantile RegressionData-Driven Forecasting

  18. Trivial Prompt Reframing Bypasses Safety Guardrails in Googleś MedGemma-4B

    Jul 9, 2026Avi-ad Avraam BuskilaLarge Language Model SafetyAttack-Success Rate

  19. Why3-py: A Tool for Formal Verification of Hypothesis Testing and Meta-Analysis in Python

    Jul 4, 2026Akira Tanaka, Yusuke KawamotoPythonTwo-Sample Testing

  20. Statistically Valid Post-Training Hyperparameter Selection: From Tuning to Guarantees

    Jun 24, 2026Amirmohammad Farzaneh, Osvaldo SimeoneTwo-Sample TestingModel Selection

  21. Bayesian control for coding agents

    Jun 23, 2026Theodore Papamarkou, Vladislav Smirnov, Viktor Mazanov +4Coding AgentsLarge Language Model Generation

  22. Betting on Moments: Legendre Jumper Martingales for Online Exchangeability Testing

    Jun 18, 2026Johan Hallberg SzabadváryConformal Test MartingalesTwo-Sample Testing

  23. Sequential Kernel-based Conditional Independence Testing via Adaptive Betting

    Jun 17, 2026Zheng He, Danica J. SutherlandConditional IndependenceTwo-Sample Testing

  24. A nonparametric two-sample test using a parametric integral probability metric

    Jun 15, 2026Yuha Park, Yongdai KimTwo-Sample TestingExponential Family

  25. Finite Resources False Discovery Rate Control in Structured Hypothesis Spaces

    Jun 13, 2026Binyamin Perets, Shie MannorFalse Discovery RateTwo-Sample Testing

  26. From Persistence to Survival: Hypothesis Testing, Effect Sizes and Vectorisation for Topological Features

    Jun 10, 2026Juliette Murris, Bernadette Stolz, Karsten BorgwardtPersistent HomologyTopology

  27. LOTTERY: Learning from Reference-Only Samples in Two-Sample Testing under Size Asymmetry

    Jun 7, 2026Xunye Tian, Zhijian Zhou, Liuhua Peng +1Two-Sample TestingImbalanced Classification

  28. Sharp Low-Degree Thresholds for Planted-vs-Planted Testing

    Jun 3, 2026Anda Skeja, Daniel Gutiérrez Espinoza, Fiona Skerman +1Two-Sample TestingDecision Thresholds

  29. Statistical Testing on Directed Graphs by Surrogate Data Generation

    May 30, 2026Chun Hei Michael Chan, Alexandre Cionca, Dimitri Van De VilleInhomogeneous Random GraphsGraph Signal Processing

  30. Counterfactual Explanations for Deep Two-Sample Testing

    May 29, 2026Wei-Cheng Lai, Marco Simnacher, Christoph LippertTwo-Sample TestingCounterfactual Explanation

  31. Optimal Rates for Differentially Private Hypothesis Testing with E-values

    May 27, 2026Ben Jacobsen, Tomas Gonzalez, Gavin Brown +2Two-Sample TestingOptimal Power Shutoff

  32. Semi-Supervised Hypothesis Testing by Betting on Predictions

    May 27, 2026Yaniv Tenzer, Elad Tolochinsky, Yaniv RomanoUnlabeled DataTwo-Sample Testing

  33. Data-driven sparse identification of governing PDEs via knockoff filters and multi-criteria trade-offs

    May 26, 2026Pongpisit Thanasutives, Naichang Ke, Yoshinobu KawaharaPartial Differential EquationsFalse Discovery Rate

  34. Constraint-Anchored Attribution: Feasibility-Certified Counterfactuals and Bonferroni-PAC Sufficient Subsets for Neural CO Policies

    May 24, 2026Sohaib LafifiNeural Combinatorial OptimizationCredit Assignment

  35. Spiking the training data to correct for test set contamination

    May 24, 2026Johnny Tian-Zheng Wei, Jerry Li, Ameya Godbole +1Training DataTwo-Sample Testing

  36. On the Sample Complexity of Robust Binary Hypothesis Testing

    May 23, 2026Shankar Vallinayagam, Ankit Pensia, Varun JogTwo-Sample TestingOptimal Sample Complexity

  37. Entropy Equivalence Testing

    May 22, 2026Clément L. Canonne, Yash Pote, Jonathan Scarlett +1Two-Sample TestingOptimal Sample Complexity

  38. A Martingale Kernel Independence Test

    May 21, 2026Felix Laumann, Zhaolu Liu, Mauricio BarahonaTwo-Sample TestingConformal Test Martingales

  39. Statistical Unlearning of Distributions: A Hypothesis Testing Approach

    May 15, 2026Aaradhya Pandey, Sanjeev KulkarniExact UnlearningDistributions

  40. A Regret Perspective on Online Multiple Testing

    May 13, 2026Qingyang Hao, Kongchang Zhou, Fang Kong +1False Discovery RateTwo-Sample Testing

  41. Robust Sequential Experimental Design for A/B Testing

    May 13, 2026Qianglin Wen, Xiangkun Wu, Chengchun Shi +4Bayesian Experimental DesignTwo-Sample Testing

  42. Uncertainty Quantification for LLM-based Code Generation

    May 12, 2026Senrong Xu, Yuhao Tan, Yanke Zhou +6Code GenerationLarge Language Model Uncertainty

  43. Semiparametric Efficient Test for Interpretable Distributional Treatment Effects

    May 8, 2026Houssam Zenati, Arthur GrettonHeterogeneous Treatment EffectsTwo-Sample Testing

  44. Adaptive auditing of AI systems with anytime-valid guarantees

    May 7, 2026Siyu Zhou, Patrick Vossler, Venkatesh Sivaraman +2Model AuditingTwo-Sample Testing

  45. Kernel Selection is Model Selection: A Unified Complexity-Penalized Approach for MMD Two-Sample Tests

    May 7, 2026Yijin Ni, Xiaoming HuoMaximum Mean DiscrepancyKernel Method

  46. Practical validation of synthetic pre-crash scenarios

    May 6, 2026Jian Wu, Ulrich Sander, Carol Flannagan +1Two-Sample TestingValidation

  47. A Semi-Supervised Kernel Two-Sample Test

    May 3, 2026Gyumin Lee, Shubhanshu Shekhar, Ilmun KimTwo-Sample TestingCovariate Balancing

  48. Finite-Sample Analysis of Elimination in Active Hypothesis Testing

    May 1, 2026Ziyuan Lin, Hoang Ngoc Nguyen, Jie Xu +1Two-Sample TestingFinite-Sample