Confidence Intervals

Momentum

12 papers in the last four weeks, up 300% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 62

All topics
CardsList
  1. Reserve-Aware Contrast Certificates for Conservative Bandits with Uncertain Baselines

    Sep 30, 2026Qinchuan ChengBanditsConservative

  2. How Much Can Reliability Drift Under a Fixed Confidence Distribution?

    Sep 30, 2026Wenhao Liang, Lin Yue, Wei Emma Zhang +3Confidence IntervalsFragility

  3. Sharp Limits for Honest Uncertainty in Hard-Budget Repeated Evaluation

    Sep 24, 2026Yezhou Cheng, Runjia Du, Zeming Liu +5Confidence IntervalsControlled Study

  4. Overlay_dx - Automating forecasting evaluation

    Sep 21, 2026Long Ngo, Mohammed Amine Chamli, Jonathan Rivalan +1Time Series ForecastingEvaluation Metrics

  5. Prediction-Powered Smoothing and Validation for Disaggregated AI Evaluation

    Sep 17, 2026Sho Kawano, Zehang Richard Li, Paul A. ParkerArtificial Intelligence EvaluationConfidence Intervals

  6. From matrix inversion to constraints: provably tighter confidence regions for importance weights in label shift

    Sep 13, 2026Mushan Li, Kihyun Han, Yanyuan MaImportance WeightingDomain Adaptation

  7. Scored vs. Generated Readouts in Behavioral Language Models: An Empirical Study of Elicitation Format

    Sep 9, 2026Touchapon Kraisingkorn, Krittin Pachtrachai, Wachiravit ModecruaFree-Form Textual RationalesReadout

  8. MiNCE: Nonparametric, Strongly Consistent Confidence Envelopes for Band-Limited Functions and their Smoothed Spectra

    Sep 8, 2026Balázs Csanád Csáji, Bálint HorváthConfidence IntervalsExponential Family

  9. Distribution-free inference on the number of changepoints

    Sep 8, 2026Rohan Hore, Aaditya RamdasChange-Point DetectionConfidence Intervals

  10. Common-Witness Certificates and Sharp Feature Bounds for Counterfactual Image Auditing

    Sep 3, 2026Usef Faghihi, Amir SakiWitnessesFinite-Sample Certificates

  11. When Prediction Error Is Not Enough: Evaluating Nuisance-Function Prediction for Causal Estimation

    Aug 30, 2026Cong CaoCausal InferencesPrediction Error

  12. ChronoState: Hidden Elapsed-Time Conditioning for Temporal-State Action Selection in Frozen-Backbone Language Models

    Aug 10, 2026Sam Siavoshian, Omar Ramadan, Amir K. Saeed +3ChronosFrozen Language Model

  13. Opportunity Is Not Realizability: Selection-Valid Diagnostics for Multi-LLM Routing

    Aug 8, 2026Ibne Farabi Shihab, Abu Sa-Adat Mohamed Moon-Im Al Ahsan, Md Najmus SwaqeebLarge Language Model RoutingPossibilities

  14. Leveraging AI for fine-grained food safety risk forecasting in sparse data conditions

    Aug 3, 2026Dongqi Wang, Weiwei Chen, Han Zhou +1Scalable OversightConfidence Intervals

  15. Vulnerabilities, Secrets and Misconfiguration in the Highest-Exposure Docker Hub Images

    Aug 2, 2026Cristhian Kapelinski, Beatriz Machado, Diego KreutzCommon Vulnerabilities And ExposureConfidence Intervals

  16. Bootstrapping Self-Supervised Learning of Binary Classification Using Error Bounds: A Case Study on a Robotic Insertion Task

    Jul 31, 2026Zebin Duan, Norbert Krüger, Juan Heredia +2Uncertainty-Aware ClassificationPrediction Error

  17. Breaking the Curse with BAND: Nonparametric Distribution Estimation in High Dimensions

    Jul 29, 2026Shuo-Chieh Huang, Chien-Ming Chi, Jau-er ChenExponential FamilyDensity Ratio Estimation

  18. Same Evidence, Different Target: Decoding How Diagnostic Evidence Bears on Causal Questions from Language-Model States

    Jul 29, 2026Weiyi Kong, Zhuoran LiDiagnosisEvidence Conflict

  19. FloDR: An invertible dimensionality reduction method based on a normalising flow

    Jul 28, 2026Abdallah Baraka, Daniel ProbstDimensionality ReductionNormalizing Flows

  20. Characterisation of Density-based FM generation methods in the context of Information Fusion

    Jul 25, 2026Yanhao Huang, Christian WagnerFuzzyUncertainty-Aware Fusion

  21. Priors learned from legacy reconstructions inherit undetectable overconfidence

    Jul 23, 2026Ali Siahkoohi, Sina AlemohammadBayesian Inverse ProblemsConfidence Intervals

  22. Sound Probabilistic Safety Bounds for Large Language Models

    Jul 22, 2026Mahdi Nazeri, Anne-Kathrin Schmuck, Sadegh Soudjani +1Large Language Model SafetyProbabilistic Safety

  23. MTEB-BR: A Text Embedding Benchmark for Brazilian Portuguese

    Jul 6, 2026Tardelli Ronan Coelho StekelPortugueseText Embeddings

  24. Estimating Uncertainty in Classifier Performance with Applications to Large Language Models and Nested Data

    Jun 24, 2026Kylie AnglinConfidence IntervalsLarge Language Model Classification

  25. Confidence Sequences for Online Statistical Model Checking of Markov Decision Processes

    Jun 24, 2026Konstantin Kueffner, Tobias Meggendorfer, Maximilian Weininger +1Markov Decision ProcessesProbabilistic Model Checking

  26. When Top-1 Fails: Calibrating LoRA Monitors for Masked Diffusion LMs

    Jun 23, 2026Lucky Verma, Pratik YadavDiffusion Language ModelsMasked Diffusion Language Models

  27. Sim-to-Real Betting on the E-Process: Bringing "simulators" to anytime-valid confidence sequences

    Jun 23, 2026Yujia Chen, Bowen WengSim-To-Real GapMonte Carlo

  28. Learning-Based Decision Making for Combustion Phasing Control in Multi-Fuel CI Engines with Latent Fuel Reactivity Estimation

    Jun 16, 2026Rajasree Sarkar, Aditya Satish Patil, Arunava Banerjee +4Combustion ControlGenerative Control Policies

  29. GitInject: Real-World Prompt Injection Attacks in AI-Powered CI/CD Pipelines

    Jun 7, 2026Jafar Isbarov, Umid Suleymanov, Ilia Shumailov +1Indirect Prompt InjectionAi-Based

  30. A Joint Finite-Sample Certificate for Adaptive Selective Conformal Risk Control

    Jun 7, 2026Xiaoli Yu, Jiamiao LiuConformal Risk ControlFinite-Sample Certificates

  31. Unveiling the Entropy Dynamics of Chain-of-Thought Reasoning

    Jun 1, 2026Ting Xu, Xu He, Yupu Lu +4Chain-of-Thought ReasoningConfidence Intervals

  32. Bandit Simulation for Average Reward Inference

    May 30, 2026Samya Praharaj, Chih-Yu Chang, Koulik Khamaru +1BanditsConfidence Intervals

  33. Statistical Inference for Stochastic Gradient Descent Beyond Finite Variance

    May 25, 2026Jose Blanchet, Peter Glynn, Wenhao YangStochastic Gradient DescentConfidence Intervals

  34. Learning Context-conditioned Gaussian Overbounds for Convolution-Based Uncertainty Propagation

    May 15, 2026Ruirui Liu, Xuejie Hou, Yiping Jiang +1Uncertainty QuantificationConfidence Intervals

  35. Foundations of Reliable Inference: Reliability-Efficiency Co-Design

    May 11, 2026Jiayi HuangUncertainty-Aware ClassificationBayesian Neural Networks

  36. On Uniform Error Bounds for Kernel Regression under Non-Gaussian Noise

    May 10, 2026Johannes Teutsch, Oleksii Molodchyk, Marion Leibold +2Non-GaussianityUncertainty Quantification

  37. Skill Drift Is Contract Violation: Proactive Maintenance for LLM Agent Skill Libraries

    May 9, 2026Linfeng Fan, Yuan Tian, Ziwei Li +1ContractsViolation

  38. Asymptotically Log-Optimal Bayes-Assisted Confidence Sequences for Bounded Means

    May 8, 2026Valentin Kilian, Stefano Cortinovis, François CaronConfidence IntervalsBayesian

  39. From Assistance to Agency: Rethinking Autonomy and Control in CI/CD Pipelines

    May 8, 2026Marcus Emmanuel Barnes, Taher A. Ghaleb, Safwat HassanConfidence Intervals

  40. Optimal Confidence Band for Kernel Gradient Flow Estimator

    May 7, 2026Yuqian Cheng, Zhuo Chen, Qian LinConfidence IntervalsWasserstein Gradient Flows

  41. Robust Parameter Learning for Uncertain MDPs

    May 2, 2026Yannik Schnitzer, Alessandro Abate, David ParkerMarkov Decision ProcessesLearning-Augmented Algorithms

  42. Revisiting Active Sequential Prediction-Powered Mean Estimation

    Apr 20, 2026Maria-Eleni Sfyraki, Jun-Kun WangConfidence IntervalsProbability

  43. Approximate full conformal prediction in an RKHS

    Jan 19, 2026Davidson Lova Razafindrakoto, Alain Celisse, Jérôme LacailleOnline Conformal PredictionConfidence Intervals

  44. Efficient Conformal Prediction for Regression Models under Label Noise

    Sep 18, 2025Yahav Cohen, Jacob Goldberger, Tom TirerOnline Conformal PredictionConfidence Intervals

  45. PERRY: Policy Evaluation with Confidence Intervals using Auxiliary Data

    Jul 26, 2025Aishwarya Mandyam, Jason Meng, Ge Gao +4Policy EvaluationConfidence Intervals

  46. CLEAR: Calibrated Learning for Epistemic and Aleatoric Risk

    Jul 10, 2025Ilia Azizi, Juraj Bodik, Jakob Heiss +1Uncertainty QuantificationConfidence Intervals

  47. Bayesian Deep Learning for Discrete Choice

    May 23, 2025Daniel F. Villarraga, Ricardo A. DazianoDiscrete Choice ModelsBayesian Neural Networks

  48. On the Sublinear Regret of Continuous K-Max Bandits

    Feb 19, 2025Yu Chen, Siwei Wang, Longbo Huang +1Stochastic Multi-Armed Bandits\Widetilde{\Mathcal{O}}(\Sqrt{T})$ Regret