Selective Prediction

Momentum

32 papers in the last four weeks, up 88% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 176

All topics
CardsList
  1. System Switch: When Should a Fast Decision Model Stop and Think?

    Oct 7, 2026Gian Luca BailoLLM Decision-MakingSelective Prediction

  2. Epistemic Uncertainty-Aware Defect Detection for Quality Control in Medical Device Manufacturing

    Oct 6, 2026Raham A. Butt, Marco Romanelli, Roche C. de GuzmanSelective PredictionEpistemic Uncertainty

  3. Careful Judge: Safe and Efficient Human-AI Collaborative Decision Making

    Oct 6, 2026Chenyu Zhang, Rachel Luo, Boyi Li +3Human-AI Decision MakingHuman-in-the-Loop AI

  4. Knowing When to Trust a Prior: Reliability-Gated Cue Fusion for Video Gaze Prediction

    Oct 6, 2026Lichen Zhu, Yueqian Lin, Yiheng Wang +2Gaze EstimationSelective Prediction

  5. Structure-Aware Graph Abstention for Reliable Selective Forecasting

    Oct 6, 2026Jianxiang Xie, Belal AlsinglawiMultivariate Time Series ForecastingLong-Term Time Series Forecasting

  6. SAFE-MR: Evidence Sufficiency Learning for Selective Multimodal Rumor Detection

    Oct 5, 2026Shiwen NiMultimodal RobustnessSelective Prediction

  7. Grounding with Confidence: Controllable Generative Video Temporal Grounding

    Sep 30, 2026Jinhao Chen, Benlei Cui, Ruijian Jia +7Temporal Video GroundingSelective Prediction

  8. The Geometry of Randomized Smoothing on Feasible Sets

    Sep 30, 2026Syed Izhan Khilji, Alireza Furutanpey, Schahram DustdarRandomized SmoothingSelective Prediction

  9. When the Right Answer Is Missing: An Arithmetic-Dependent Rejection Bottleneck in Jev

    Sep 30, 2026Jike Zhong, Ming Li, Yuxiang LaiNumerical Reasoning in Language ModelsSelective Prediction

  10. RAGScope: A Leakage-Controlled, Cost-Aware Evidence-Gating Protocol for RAG Hallucination Triage

    Sep 30, 2026Zeming Liu, Qibai Chen, Jingtao Zhang +1Selective PredictionHallucination Detection

  11. Benchmarking System One decision models against trained classifiers and language models for automated decision gates

    Sep 29, 2026Amir Rafe, Subasish DasLLM Decision-MakingLLM Evaluation

  12. HARISSA: Inference-Time Self-Checks for Efficient and Safe Local Language Model Deployment

    Sep 29, 2026Kenan Alkiek, Moontae Lee, David Jurgens +1On-Device Language Model InferenceSelective Prediction

  13. SafeVantage: Vantage-Aware Memory for Reliable Embodied Decisions

    Sep 29, 2026Sean Hardesty Lewis, Zuyi Guo, Benwang Chen +3Next-Best-View PlanningSelective Prediction

  14. Mixed-Prior Decision Risk for Open-Set Recognition

    Sep 28, 2026L. A. Erlygin, P. D. Proskura, A. A. ZaytsevSelective PredictionOpen-Set Recognition

  15. Certified Selective Automation of LLM Agent Evaluation

    Sep 28, 2026Chengguang Gan, Yunhao Liang, Qinghao Zhang +1LLM-as-a-JudgeSelective Prediction

  16. Curating Merchant-Matching Training Data with Two Confidence-Gated Local LLM Judges

    Sep 27, 2026Donghao Huang, Jinling Pei, Zhaoxia WangLLM-as-a-JudgeSelective Prediction

  17. UQ-LOB: Uncertainty-Aware Limit Order Book Mid-Price Forecasting

    Sep 25, 2026Derrick Gilchrist Edward Manoharan, Eljas Linna, Kestutis Baltakys +2Uncertainty QuantificationSelective Prediction

  18. GCUL: Ambiguity Identification in Text Emotion Classification via Cluster-Guided Learning

    Sep 24, 2026Zhongqi Fan, Tianyou Zhang, Fei ChenSelective Prediction

  19. JEV-as-a-Judge: Accept When Confident, Escalate When Unsure

    Sep 22, 2026Yubo Li, Yidi Miao, Ramayya Krishnan +1LLM-as-a-JudgeLanguage Model Generation Evaluation

  20. Intrinsic Sequence-Likelihood Confidence in Retrieval-Dominated Extractive QA: Two Pre-Specified Negatives, and What They Do and Do Not Attribute

    Sep 17, 2026Gunwoo Lee, Changmin Sung, Sang-Hwan Gwak +3LLM EvaluationSelective Prediction

  21. When Should LLMs Abstain? Chain-of-Self-Questioning for Selective Risk Control

    Sep 15, 2026Ali ŞenolSelective PredictionLLM Prompting

  22. Predicting Human Disagreement for Calibrated Dynamic Facial Expression Recognition

    Sep 15, 2026Yiming Wang, Frederick W. B. Li, Jingyun WangAnnotator DisagreementUncertainty Quantification

  23. Symmetry-Aware Likelihood-Orbit Aggregation for Selective Left-Right Claim Verification

    Sep 15, 2026Zhouzhi Xiong, Chuxi Zhang, Weizhen He +3VLM EvaluationVisual Spatial Reasoning

  24. When Should a World Model Move? Loss-Conditioned State Execution

    Sep 14, 2026Jintao Xu, Zhengyu Chen, Ben Zhang +2Selective PredictionProbabilistic Forecasting

  25. Competence-Gated Pooling of Language Models and Priors for Event Forecasting

    Sep 14, 2026Aditi Tiwari, Aashrith Bandaru, Heng JiEvent Time PredictionSelective Prediction

  26. Calibration-Aware Uncertainty Cascades for Efficient Heterogeneous Model Collaboration

    Sep 12, 2026Yilin Zhang, Han Jiang, Cai Xu +2Selective PredictionCost-Aware Inference

  27. Safe to Stop? Risk-Constrained Stopping for Sequential Clinical Diagnosis Agents

    Sep 9, 2026Yuexin Wu, Vasile RusSelective PredictionAI Agent Evaluation

  28. Measuring consistency via ensemble margin and local prediction variability: Auditing decision systems in the presence of predictive multiplicity

    Sep 1, 2026Sinjini Banerjee, Tim Marrinan, Anand D. SarwateSelective PredictionEnsemble Learning

  29. TRUST: Threshold-Recalibrated Uncertainty-Safe Training for Certified Dismissal in Breast Cancer Screening

    Aug 31, 2026Parham Hajishafiezahramini, Matthew Hamilton, Edward Kendall +2Breast CancerSelective Prediction

  30. DreamLedger: Where to Refuse World-Model Imagination Using Execution-Settled Credit

    Aug 24, 2026Xianyao Li, Ruitong Tian, Rui Min +2Selective PredictionRobotics

  31. Credal Large Language Models for Semantic Commitment under Uncertainty

    Aug 24, 2026Shireen Kudukkil Manchingal, Sofiia Nikolenko, Fabio CuzzolinSelective PredictionConfidence Estimation in Language Models

  32. Verifiable abstention makes AI leak diagnosis accountable in urban water distribution networks

    Aug 19, 2026Tianwei Mu, Yue Wang, Mingzhe Yuan +8Selective PredictionAnomaly Localization

  33. Predictive Memory Localization: Forecasting Selective Intervention Paths from Internal Signals

    Aug 13, 2026Jinhao Jing, Tian Zeyu, Lucas Qingyang Fang +4Selective PredictionMechanistic Interpretability

  34. Non-Degenerate Risk Certification for Automated Security Decisions: A Decision-Contract Theory with ATT&CK-Aligned Triage as a Worked Instance

    Aug 12, 2026Zhenpeng LiAI AssuranceSelective Prediction

  35. Evaluating and Calibrating Diffusion Model-derived Uncertainty for Quantitative MRI Mapping

    Aug 12, 2026Shishuai Wang, Stefan Klein, Juan A. Hernandez-Tamames +1Uncertainty QuantificationSelective Prediction

  36. Robust Ambiguity Detection (RAD) From Model- and Feature-Space Consistency

    Aug 12, 2026Manya Singh, Mark T. Keane, Arjun PakrashiSelective PredictionInterpretable ML

  37. Certify or Refuse: A Cross-Model Map for Selective Risk Control with Coverage Floors under Covariate Shift

    Aug 11, 2026Jiamiao Liu, Dewen Qiao, Yu Zhang +1Selective PredictionCovariate Shift

  38. ConfTriage: A Calibration-Aware LLM Triage Framework for Pulmonary Nodule Malignancy with Selective Specialist Deferral

    Aug 11, 2026Md Rabiul Islam, Samir Abdaljalil, Erchin Serpedin +1Selective PredictionClinical Decision Support

  39. Rethinking LLM Verification: Evidence Structure, Uncertainty, and Selective Refinement

    Aug 11, 2026Uma Ranjan, Kunal Tilaganji, Aditya Koul +9LLM GroundingLLM Answer Verification

  40. TelemetrySuffBench: Is Agent Telemetry Sufficient for Failure-Origin Diagnosis?

    Aug 8, 2026Yuxuan Zhu, Peng PuSelective PredictionFault Detection