Reasoning Consistency in Language Models

Latest papers 43

All topics
CardsList
  1. Training Language Models To Be Coherent Decision-Makers

    Oct 6, 2026Khurram Yamin, Xavier Fernandes, Paul Koch +2LLM Decision-MakingDecision-Making under Uncertainty

  2. ACTR: Aligning Thoughts and Responses for Multilingual Safety in Reasoning LLMs

    Sep 29, 2026Xianhui Zhang, Jian Yu, Chengyu Xie +6Adversarial Attacks on LLMsLLM Safety Alignment

  3. Who Is Left of Whom? Tracing Spatial Evidence and Role Binding in Relative-Position Reasoning

    Sep 28, 2026Yingjin Song, Denis Paperno, Albert GattVisual Spatial ReasoningRelational Reasoning

  4. Can LLMs Follow Medical Expert Logic? A Benchmark for Hierarchical Logical Consistency in Risk-of-Bias Assessment

    Sep 12, 2026Jiayu Huang, Zichen Tang, Qianhui Ling +2Reasoning Consistency in Language ModelsClinical Language Model Evaluation

  5. Is This Your Final Answer? Cross-Contextual Consistency as a Measure of LLM Credibility

    Aug 10, 2026Siyang Wu, Yibo Jiang, Bryon AragamPrompt SensitivityLLM Evaluation

  6. TrAC: Trace-Conditioned Answer Consistency for Efficient Uncertainty Quantification in LLMs

    Aug 1, 2026Dahai Yu, Lin Jiang, Rongchao Xu +1LLM EvaluationReasoning Consistency in Language Models

  7. Reason Popper-ly: Patching In-Context Reasoning with Inductive Logic Programming

    Jul 25, 2026Zirong Chen, Meiyi MaLogic ProgrammingReasoning Consistency in Language Models

  8. Beyond Semantic Equivalence: Logical Graphs for LLM Uncertainty Quantification

    Jul 18, 2026Yanni Dong, Minghua Liu, Meilin Zhu +2Reasoning Consistency in Language ModelsLLM Reliability

  9. Implicit Reasoning Steering via Concept Chaining

    Jul 15, 2026Xiao Ye, Sanika Chavan, Yuxi Huang +4Adversarial Attacks on LLMsReasoning Consistency in Language Models

  10. Can We Trust LLM's Logic? Quantifying Uncertainty, Coherence, and Robustness via a Graph-Based Framework

    Jul 9, 2026Riccardo Revalor, Jalees Rehman, Debjit PalCoT FaithfulnessLLM Reasoning with Graphs

  11. Clinical Reasoning Graphs: Structured Evaluation of LLM Diagnostic Reasoning Reveals Competence Without Consistency

    Jun 29, 2026Nisarg A. PatelLLM EvaluationReasoning Consistency in Language Models

  12. Invariant Reasoning Directions in Latent Trajectories of Language Models

    Jun 28, 2026Arun Vignesh Malarkkan, Manan Roy Choudhury, Utkarsh Byahut +3Reasoning Consistency in Language ModelsImplicit Reasoning in Language Models

  13. Decodable but Not Faithful: Coupling Natural-Language Rationales to Programmatic Verifiers

    Jun 19, 2026Vatsal Ananthula, Adarsh KumarappanFaithfulness of Language Model ExplanationsLLM Auditing

  14. Coherence Under Commitment: Probing Generalization and Vacuous Memorization in LLM Logical Reasoning

    Jun 19, 2026Noor Islam S. Mohammad, Mahmudul HasanLLM EvaluationReasoning Consistency in Language Models

  15. The Consistency Dilemma in LLMs: Generator-Evaluator Agreement and Vulnerability to Mistakes

    Jun 16, 2026Marina Mancoridis, Zoë HitzigLLM EvaluationReasoning Consistency in Language Models

  16. Quantifying Consistency in LLM Logical Reasoning via Structural Uncertainty

    Jun 15, 2026Baishali Chaudhury, Mengdie Flora Wang, Hyunji Hayley Park +3Reasoning Consistency in Language ModelsLLM Reliability

  17. Operadic consistency: a label-free signal for compositional reasoning failures in LLMs

    Jun 11, 2026Nathaniel Bottman, Yinhong Liu, Kyle RichardsonCompositional ReasoningReasoning Consistency in Language Models

  18. Agreement in Representation Space for Open-Ended Self-Consistency

    Jun 10, 2026Paula Ontalvilla, Gorka Azkune, Aitor OrmazabalOpen-Ended GenerationSelf-Consistency Decoding

  19. Boosting Self-Consistency with Ranking

    Jun 3, 2026Maria Marina, Daniil Moskovskiy, Sergey Pletenev +3Self-Consistency DecodingLLM Reranking

  20. ConsisGuard: Aligning Safety Deliberation with Policy Enforcement in LLM Guardrails

    May 29, 2026Yan Wang, Zhixuan Chu, Zihao Xue +9LLM GuardrailsLLM Safety Alignment

  21. Same Evidence, Different Answers: Canonical-Context On-Policy Distillation for Multi-Turn Language Models

    May 28, 2026Zizhuo Lin, Quanling Liu, Jinsheng Quan +6LLM GroundingReasoning Consistency in Language Models

  22. Self-Consistency via Marginal Sharpening

    May 27, 2026Aleksei Arzhantsev, Otmane Sakhi, Nicolas ChopinEfficient Language Model ReasoningReasoning Consistency in Language Models