Abstention

Momentum

8 papers in the last four weeks, level with the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 65

All topics
CardsList
  1. Audit-First VAPO: Risk-Certified Selective Updates under Imperfect Verification

    Sep 27, 2026Miaobo Hu, Shuhao Hu, Xiaobo Guo +5Finite-Sample CertificatesModel Auditing

  2. The Commit-Abstain Circuit: Why Language Models Hallucinate Instead of Abstaining

    Sep 26, 2026Vy Nguyen, Ziqi Xu, Jeffrey Chan +5Large Language Model HallucinationAbstention

  3. Certified Against Which Oracle? Execution Labels Set the Reported Risk of Conformal Abstention for Text-to-SQL

    Sep 22, 2026Jiamiao Liu, Dewen Qiao, Yu Zhang +1OraclesText-To-Sql

  4. Abstention and Noise Filtering: Two Missing Primitives of Softmax Attention

    Sep 18, 2026Richard Zhe WangGumbel-Softmax RelaxationGating

  5. When Should LLMs Abstain? Chain-of-Self-Questioning for Selective Risk Control

    Sep 15, 2026Ali ŞenolAbstentionCommitment

  6. A decision-basis contract for auditable LLM-assisted medical billing verification: deterministic rules, verbatim evidence, and fail-closed abstention

    Sep 14, 2026Jan Hölter, Kevin Geis, Benjamin Raab +1Clinical Decision SupportCategory-Aware Atomic Claims

  7. Verifiable abstention makes AI leak diagnosis accountable in urban water distribution networks

    Aug 19, 2026Tianwei Mu, Yue Wang, Mingzhe Yuan +8LeakageModel Auditing

  8. TRAPSBench: Vision-Language Models Encode but Fail to Express Epistemic Restraint

    Aug 13, 2026Fnu Pramono, John Cai, Sourabh KulkarniVisual EvidenceAbstention

  9. Governed Persistent Memory: Source-Bound State Semantics and Fail-Closed Release for Long-Horizon Agents

    Aug 12, 2026Guodong XuLong-Term Agent MemoryAdmissibility

  10. REIN: Bridging the Gap between Reasoning and Reliability via Reflection and Abstention Alignment

    Aug 8, 2026Zhengze Huang, Luyang Yu, Di Hong +5Large Reasoning ModelsAbstention

  11. Evidential Rule Learning for Interpretable Classification with Abstention

    Aug 6, 2026Javier Fumanal-Idocin, Javier Andreu-PerezEvidential UncertaintyInterpretability

  12. HopRefusalBench: Diagnosing Refusal Failures in Search-Augmented Agents for Multi-Hop Reasoning

    Aug 2, 2026Jianan Xie, Xin Sun, Zhongqi Chen +3Search AgentsMulti-Hop Reasoning

  13. Abstention as an Action Can Kill Both the Reward Gradient and the KL Anchor: Collapse Law and Repair for Error-Penalized Reinforcement Learning

    Jul 31, 2026Xujun Che, Yuchen Yuan, Weida Zhao +1Reward GradientsAbstention

  14. TwistedMerge: Certified Higher-Order Diagnostics and Abstention for Model Merging

    Jul 23, 2026Ting Gong, Shitan XuContinual Model MergingMerge

  15. Move First, Commit Later: Selective LiDAR-to-BIM Global Initialization via Sequential Consensus with Symmetry-Aware Abstention

    Jul 19, 2026Yujie Zhang, Yuxuan Guo, Jiashuo Zheng +3LidarImage Registration

  16. To Answer or to Abstain: Mitigating Search-Agent Hallucinations via Abstention-Aware Reinforcement Learning

    Jul 12, 2026Fengji Zhang, Tianyu Fan, Yuxiang Zheng +4Abstention

  17. AgentAbstain: Do LLM Agents Know When Not to Act?

    Jul 11, 2026Xun Liu, Yi Evie Zhang, Vira Kasprova +5Large Language Model AgentsLanguage-Model Agents

  18. Bayesian Best-Arm Identification with Abstention: A Polynomial-to-Exponential Phase Transition

    Jun 28, 2026Yuqi Huang, Yunlong Hou, Vincent Y. F. TanBayesianToken Budget Allocation

  19. Agentic Abstention: Do Agents Know When to Stop Instead of Act?

    Jun 27, 2026Han Luo, Bingbing Wen, Lucy Lu WangLanguage-Model AgentsAbstention

  20. The Clinician's Veto: Navigating Trust, Liability, and Uncertainty in Autonomous AI Prescribing

    Jun 23, 2026Eileanor LaRocco, Sarah Tan, Adarsh Subbaswamy +4Medication LeafletClinician Trust

  21. Abstention-Aware Personalized Object Rearrangement via Uncertainty-Guided LLM Assistance

    Jun 15, 2026Sam Collin, Ali AyubConceptual ReorganizationAffordances

  22. Look Again Before You Abstain:Budgeted Conformal Evidence Acquisition for Reliable Vision-Language Model

    Jun 15, 2026Jian Xu, Delu Zeng, John Paisley +1Recent Vision-Language ModelsVisual Evidence

  23. SICI: A Semantic-Pragmatic Complexity Index Reveals Regime Shifts in LLM Stance Detection

    Jun 11, 2026Fuqiang Niu, Bowen ZhangCross-Topic Arabic Stance DetectionStructural Complexity

  24. TOPSIS-RAD: Ranking According to Desires

    Jun 5, 2026Leonardo Fernandes Costa, Helder Gomes Costa, Diogo Lima +1RankingDesiderata

  25. CARVE-Q: Quantum-Proposed, Classically Certified Interactive Driving Repair

    Jun 3, 2026Yifan WangPost-Quantum CryptographyRepair

  26. What Benchmarks Don't Measure: The Case for Evaluating Abstention Competence in Autonomous Agents

    Jun 1, 2026Victor Ojewale, Suresh VenkatasubramanianAgentic EvaluationsAutonomous Agents

  27. Repair Before Veto: Repair-Augmented Constraint Learning for Contextual Decisions

    Jun 1, 2026Yifan WangRepairUncoupled Learning

  28. CARVE: Certified Affordable Repair of Vetoed Maneuvers via Envelopes for Interactive Driving

    May 31, 2026Yifan WangHuman DrivingReachability

  29. AbstainGNN: Teaching Graph Neural Networks to Abstain for Graph Classification

    May 29, 2026Xixun Lin, Zhiheng Zhou, Zhengyin Zhang +9Graph Neural NetworksAbstention

  30. BOKBO (Best of K Bad Options): Calibrated Abstention for VLA Policies

    May 28, 2026Anya Singh, Cabrel Happi, Jai Relan +2AbstentionBad

  31. Clarify, Abstain or Answer? Strategising in Conversation with Belief-Augmented Generation

    May 25, 2026Joris Baan, Wilker Aziz, Barbara Plank +1ClarificationConversational Context

  32. Agreement Metrics for LLM-as-Judge Evaluation: What to Report and Why

    May 25, 2026Delip Rao, Chris Callison-BurchLarge Language Model JudgesJudgement

  33. Second Guess: Detecting Uncertainty Through Abstention and Answer Stability in Small Language Models

    May 25, 2026Ashwath Vaithinathan Aravindan, Mayank KejriwalLarge Language Model UncertaintyMultiple-Choice Questions

  34. Interpretation, Learning, and Empathy as One Constraint: A Residual-Adequacy Architecture with Accountable Abstention

    May 24, 2026Chainarong AmornbunchornvejAbstentionAbductive Reasoning

  35. The Yes-Man Syndrome: Benchmarking Abstention in Embodied Robotic Agents

    May 19, 2026Doguhan Yeke, Elif Su Temirel, Ananth Shreekumar +3Abstention

  36. Knowing When Not to Predict: Self Supervised Learning and Abstention for Safer DR Screening

    May 18, 2026Muskaan Chopra, Lorenz Sparrenberg, Jan H. Terheyden +1Self-Supervised LearningScreening

  37. Scale-Dependent Collective Adaptation in Self-Amending LLM Societies: A Cross-Family Study of Emergent Governance

    May 17, 2026Kazuya Horibe, Masaomi Hatakeyama, Gen Masumoto +2ConformityAbstention

  38. Task Abstention for Large Language Models in Code Generation

    May 16, 2026Yanke Zhou, Yuhao Tan, Senrong Xu +4Code GenerationLarge Language Model Generation

  39. Trust or Abstain? A Self-Aware RAG Approach

    May 11, 2026Xi Zhu, Ziqi Wang, Kai Mei +5Large Language Model ReliabilityLarge Language Model Backbones

  40. CHASE: Competing Hypotheses for Ambiguity-Aware Selective Prediction

    May 2, 2026Kartik Jhawar, Yuhao Geng, Atul N. Parikh +1AmbiguityAbstention

  41. Geometry-Calibrated Conformal Abstention for Language Models

    Apr 30, 2026Rui Xu, Yi Chen, Sihong Xie +1AbstentionConfidence Calibration

  42. Knowing When to Quit: A Principled Framework for Dynamic Abstention in LLM Reasoning

    Apr 20, 2026Hen Davidov, Nachshon Cohen, Oren Kalinsky +4LLM Reasoning StrategiesAbstention