Reasoning Verification

Momentum

3 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 32

All topics
CardsList
  1. Can Language Models Learn to Reject Their Own Bad Reasoning Steps?

    Oct 5, 2026Siheng Xiong, Xiaoze Liu, Yiqiao Jin +2LLM Self-CorrectionLanguage Model Decoding

  2. Hallucination Across the Reasoning Lifecycle: Interface Visibility, Causal Evidence, and Release Control in Large Reasoning Models

    Oct 4, 2026Zhe Yu, Mohan Li, Lei Yu +6LLM Hallucination MitigationHallucination in Language Models

  3. The Error You See Is Not the Error You Made: Progression-aware Reasoning Origin for Reasoning Error Localization

    Sep 27, 2026Yiguo Wang, Ziyuan Yang, Yi Zou +3Language Model Error DetectionReasoning Verification

  4. ReflectFact: Self-Reflective Agents for Improving Comprehension and Reasoning in Multi-Hop Fact Verification

    Aug 13, 2026Runze Zhao, Zixin Tang, Xiaoshuai Hao +4Automated Fact-CheckingAgentic Reasoning

  5. A Human Audit of OpenAIs AI-Generated Mathematical Proofs

    Aug 3, 2026Mikołaj Sienicki, Krzysztof SienickiLLM AuditingHuman Oversight of AI

  6. Answer-Conditioned Chains of Thought Degrade Verifiable-Reasoning Distillation in Large Language Models

    Jul 16, 2026Jungseob Lee, Seungyoon Lee, Suhyune Son +4CoT DistillationLanguage Model Distillation

  7. Think Again or Think Longer? Selective Verification for Budget-Aware Reasoning

    Jun 18, 2026Sajib Acharjee Dip, Dawei Zhou, Liqing ZhangLLM Inference EfficiencyCost-Aware Inference

  8. Scaling LLM Reasoning from Minimal Labels: A Semi-Supervised Framework with a Lightweight Verifier

    Jun 15, 2026Keizo Kato, Chenhui Chu, Yugo Murawaki +1Pseudo-LabelingLLM Reasoning

  9. VeriGeo: Controllable Geometry Question Generation with Numerical and Analytical Verification

    Jun 12, 2026Xiaoxian Duan, Zequn Liu, Yingce XiaSynthetic Data GenerationMultimodal Reasoning

  10. An Enigma of Artificial Reason: Investigating the Production-Evaluation Gap in Large Reasoning Models

    May 31, 2026Mingzhong Sun, Teresa Yeo, Armando Solar-Lezama +1Reasoning EvaluationLLM Interpretability

  11. Conformal Certification of Reasoning Trace Prefixes

    May 28, 2026Matt Y. Cheung, Ashok Veeraraghavan, Hanjie Chen +1Conformal PredictionLanguage Model Calibration

  12. Debate Helps Weak Judges Reward Stronger Models

    May 26, 2026Ethan Elasky, Frank Nakasako, Naman GoyalScalable OversightLLM-as-a-Judge

  13. The Hidden Signal of Verifier Strictness: Controlling and Improving Step-Wise Verification via Selective Latent Steering

    May 20, 2026Yefan Zhou, Yilun Zhou, Austin Xu +3Language Model SteeringActivation Steering

  14. A Nash Equilibrium Framework For Training-Free Multimodal Step Verification

    May 19, 2026Rohit Sinha, Kunal Tilaganji, Tanuja Ganu +3Multi-View ConsistencyGame Theory

  15. Knowledge-to-Verification: Exploring RLVR for LLMs in Knowledge-Intensive Domains

    May 18, 2026Zhonghang Yuan, Zhefan Wang, Fang Hu +7RL for Language Model ReasoningReinforcement Learning with Verifiable Rewards

  16. Unsupervised Process Reward Models

    May 11, 2026Artyom Gadetsky, Maxim Kodryan, Siba Smarak Panigrahi +2Reward ModelingProcess Reward Models

  17. LaTER: Efficient Test-Time Reasoning via Latent Exploration and Explicit Verification

    May 8, 2026Xuan Li, Yining Wang, Yuchen Liu +7CoT ReasoningEfficient Language Model Reasoning

  18. Grounding Multi-Hop Reasoning in Structural Causal Models via Group Relative Policy Optimization

    May 2, 2026Yunhan Bu, Quan Zhang, Huaping Zhang +9Structural Causal ModelsRL for Language Model Reasoning

  19. Navigating the Conceptual Multiverse

    Apr 20, 2026Andre Ye, Jenny Y. Huang, Alicia Guo +3LLM Decision-MakingHuman-AI Decision Making

  20. Reasoning on the Manifold: Bidirectional Consistency for Self-Verification in Diffusion Language Models

    Apr 17, 2026Jiaoyang Ruan, Xin Gao, Yinda Chen +5Diffusion Model AlignmentDiffusion Language Model Inference

  21. Auditing Multi-Agent LLM Reasoning Trees Outperforms Majority Vote and LLM-as-Judge

    Feb 10, 2026Wei Yang, Shixuan Li, Heng Ping +3LLM AuditingPreference Optimization

  22. The Bidirectional Process Reward Model

    Aug 3, 2025Lingyin Zhang, Jun Gao, Xiaoxue Ren +1Process Reward ModelsReasoning Verification

  23. Measuring Progress in Reasoning Toward Mathematical Discovery with Automatic Verification

    Date pendingErik Y. Wang, Sumeet R. Motwani, James V. Roggeveen +9Mathematical Reasoning BenchmarksLLM Mathematical Reasoning