Verdict

Momentum

12 papers in the last four weeks, up 300% on the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 29

All topics
CardsList
  1. Multi-Channel Mitigation of Source-Trust Shortcuts in Fact-Checking RL Agents

    Sep 29, 2026Jianchang Su, Yiwei Yang, Wei ZhangFact-CheckingAI Trustworthiness

  2. Symmetry-Aware Likelihood-Orbit Aggregation for Selective Left-Right Claim Verification

    Sep 15, 2026Zhouzhi Xiong, Chuxi Zhang, Weizhen He +3Category-Aware Atomic ClaimsVerdict

  3. No Free Checker: A Survey of Verifiers for Robot Policies

    Sep 10, 2026Yang Wan, Xihang Yue, Zhirui Liu +7Verification FrameworkPolicy Evaluation

  4. The Audit Decides the Verdict: Instrument Effects Rival Demographic Bias in LLM Decision Audits

    Sep 8, 2026Siddharth Vohra, Manikandan RavikiranLarge Language Model BiasModel Auditing

  5. Style Over Substance: Content-Invariant Wrappers Flip LLM Safety-Judge Verdicts

    Sep 8, 2026Yongxi Zhou, Wenbo Ye, Yuanzhe Liu +2Large Language Model SafetyJailbreak Success Rates

  6. Accountable AI with Grounded, Faithful, Consistent, Actionable Rationales: A Case Study in Clinical Trial Matching with VERDICT

    Sep 3, 2026Zikai Zhou, Yufei Jin, Yilin Xu +3Free-Form Textual RationalesVerdict

  7. Verdict Instability of OOD Scores under Reference Resampling

    Sep 1, 2026Donghoon Lee, Shinjin KangVerdictScores

  8. VFR-Audit: Verdict-Level Reliability for Fairness Audits in Hospital Length-of-Stay Prediction

    Aug 31, 2026Md Jannatul Rakib Joy, Viet Vo, Caslon ChuaFairness AuditsVerdict

  9. VERDICT: Training-Free Step-Wise Verification of Multimodal Reasoning via Disagreement-Aware Consensus

    Aug 11, 2026Rohit Sinha, Kunal Tilaganji, Tanuja Ganu +3Reference-Guided Multimodal In-Context VerificationMultimodal Reasoning

  10. VetScore: Risk-Weighted Fact Verification for Veterinary Long-Form QA with Citations

    Aug 4, 2026Ivan Kartáč, Jan Tovarys, Mateusz Lango +1Category-Aware Atomic ClaimsVerdict

  11. Unequal Verdicts: Investigating Gender Bias in LLM-Based Fake News Detection

    Aug 4, 2026Razieh Chalehchaleh, Reza Farahbakhsh, Noel CrespiGender BiasFake News Detection

  12. Mining Verdict Boundaries for Neural Network Verification

    Jul 31, 2026Jiawei Ren, Guanqin Zhang, Zhenya Zhang +1Neural Network VerificationUpper Bounds

  13. Early Verdicts, Better Budgets: Sequential Adaptive Rollout Allocation for Compute-Efficient RLVR

    Jul 28, 2026Pixel Nomand, Elena Voss, Marcus Hale +1Reinforcement Learning With Verifiable RewardToken Budget Allocation

  14. Validate the Dream Before You Trust Its Verdict: Admissibility for World-Model Simulators

    Jul 8, 2026Christian Oefinger, Finn Rasmus Schäfer, Korbinian Moller +2World ModelsAdmissibility

  15. Probe Choice Changes Canary-Memorization Verdicts: Three Post-Hoc Disagreement Case Studies in a Text-Dominant LoRA-Tuned Autoregressive Testbed

    Jun 30, 2026Zhichao Fan, Zexin Zhuang, Yanhang LiConversational MemoryVerdict

  16. DecomposeRL: Learning to Ask Useful, Informative, and Diverse Questions for Semi-Supervised, Traceable Claim Verification

    May 27, 2026Shubhashis Roy Dipta, Ankur Padia, Francis FerraroCategory-Aware Atomic ClaimsVerdict

  17. When Corrective Hints Hurt: Prompt Design in Reasoner-Guided Repair of LLM Overcaution on Entailed Negations under OWL2DL

    Apr 25, 2026Yijiashun Qi, Xiang Xu, Yuxuan LiLarge Language Models FailRepair