Large Reasoning Models

Latest papers 262

All topics
CardsList
  1. SanSi: A Looped Typed Decision Model for System 1.5 Thinking

    Oct 6, 2026Shuyu Gan, Young-Jun Lee, Dongyeop KangLarge Reasoning Models

  2. Interpreting Reasoning of Large Language Models via Partial Information Decomposition

    Sep 30, 2026Barproda Halder, Qiuyi Zhang, Sanghamitra DuttaLarge Reasoning ModelsReasoning Trajectory

  3. What Limits Recursive Reasoning Models: Optimization, Architecture and Test-Time Scaling

    Sep 30, 2026Yuliana Shakhvalieva, Dmitrii Kharchev, Viacheslav Bezrukov +4Recursive ModelsLarge Reasoning Models

  4. When a Kindergartener Solves Calculus: Measuring Capability Leakage in Role-Prompted Reasoning Models

    Sep 30, 2026Pakhapoom Sarapat, Saksorn Ruangtanusak, Kunat Pipatanakul +1Large Reasoning ModelsMath Problems

  5. When Reasoning Goes Astray: Attention Dynamics of Uncontrolled Reasoning

    Sep 30, 2026Yuanhe Zhang, Ziwei Wang, Jie Ren +6Large Reasoning ModelsReasoning Errors

  6. Hidden Reasoning Must Leak, but Need Not Be Readable: Fundamental Opportunities and Limits for Chain-of-Thought Monitoring

    Sep 29, 2026Mohammadali Mohammadkhani, Madhava Krishna, Yash Sarrof +1Chain-of-Thought ReasoningLarge Reasoning Models

  7. Towards Mitigating Deceptive Safety Alignment in Large Reasoning Models

    Sep 28, 2026Xiangyu Zhou, Saleh Zare Zade, Rafi Ibn Sultan +2Safety AlignmentLarge Reasoning Models

  8. Jailbreaks for Black-Box Uncertainty Quantification in Large Reasoning Models

    Sep 28, 2026Lucas Biechy, Cédric Eichler, Adrien Boiret +1Large Language Model UncertaintyLarge Reasoning Models

  9. DeShortcut-Align: Decoupling Spurious Shortcuts for Robust Safety Alignment in Large Reasoning Models

    Sep 28, 2026Qirui Liu, Yichen Sun, Yan Wang +4Safety AlignmentLarge Language Model Alignment

  10. Investigating Human--AI Discrepancies via Multiple-Solution Problems

    Sep 28, 2026Zihao Wang, Francesco Insulla, Andrea MontanariLarge Reasoning ModelsDiscrepancy

  11. Steering Language Model Goals with Value Transplant

    Sep 28, 2026Pengcheng Jiang, Fabien RogerLatent Feature InterventionsLarge Reasoning Models

  12. IVT-Guard: All-in-One Reasoning Model for AI-Generated Content Detection

    Sep 27, 2026Hongwei Niu, Yunpeng Luo, Hanjun Li +6Ai-Generated Content DetectionLarge Reasoning Models

  13. Calibration, Not Answer Selection: Distilling Internal Confidence in Reasoning Models

    Sep 27, 2026Yadong Xi, Rongsheng Zhang, Tangjie Lv +2Confidence CalibrationLarge Reasoning Models

  14. Thinking Leakage: A Causal Audit of NoThink Post-Training in Hybrid Reasoning Models

    Sep 23, 2026Zehao Liu, Vasant G. HonavarLarge Reasoning ModelsPost-Training

  15. Scaling of Capability and Efficiency at Inference Time in Large Reasoning Models

    Sep 22, 2026Moritz Laber, Zohair Shafi, Germans Savcisens +6Large Reasoning ModelsModel Size

  16. TelecomGPT-R1: Unified Post-Training for Reasoning Across Heterogeneous Telecom Tasks

    Sep 21, 2026Bohao Wang, Chenwei Wu, Hang Zou +7Large Reasoning ModelsLarge Language Models(Llms

  17. On the Efficiency-Safety Dilemma in Large Reasoning Models

    Sep 20, 2026Yifei Yang, Zouying Cao, Xingrui Wang +4Large Reasoning ModelsJailbreak Attacks

  18. GUARD: Natural Forgetting in Large Reasoning Models via Guided Answer-Reasoning Distillation

    Sep 18, 2026Zeyu Yan, Guanghao Zhou, Minghui Qiu +2Large Language Model UnlearningLarge Reasoning Models

  19. When2Think: Learning When and How Much to Reason

    Sep 17, 2026Jaejun Shim, HyunJin Kim, Young Jin Kim +1Large Reasoning ModelsVerifiable Rewards

  20. First Token Matters: Understanding Safety Collapse in Large Reasoning Models

    Sep 16, 2026Yizheng Yang, Haining Yu, Yuechen Wang +4Large Language Model SafetyLarge Reasoning Models

  21. Beyond Safe Answers: Segment-Aware Listwise Alignment for Reasoning Safety in Large Reasoning Models

    Sep 14, 2026JungMin Yun, Junehyoung Kwon, Hayeong Ryu +3Large Reasoning ModelsReasoning Skills

  22. GTA: Graph Theory Agent and Benchmark for Algorithmic Graph Reasoning with LLMs

    Sep 14, 2026Zixiang Xu, Yanbo Wang, Chenxi Wang +6Graph RepresentationsLarge Language Model Benchmarks

  23. Do Reasoning Representations Help Humans Evaluate LLM Outputs?

    Sep 8, 2026Jaewoo Lim, Sungbok Shin, Sanghyun HongLLM Reasoning StrategiesLarge Reasoning Models

  24. Does Deeper Reasoning Compromise Alignment? Revealing and Mitigating of Alignment Collapse in Large Reasoning Models

    Sep 8, 2026Yu-Hang Wu, Yu-Jie Xiong, Henghua Zhang +3Large Reasoning ModelsSafety Alignment

  25. Frontier LLMs are effective batch optimizers: Assessing reasoning models in continuous and discrete settings

    Sep 2, 2026Frank Hu, Shriram Chennakesavalu, David GraffAdaptive OptimizersOptimization Modeling

  26. Thinking effort aligns between humans and reasoning models in abductive reasoning

    Sep 1, 2026Henry ArthurLarge Reasoning ModelsAbductive Reasoning

  27. Scaling Large Reasoning Models beyond Human Supervision: A Path toward Superintelligence

    Aug 31, 2026Zhiqin Yang, Jingwen Fu, Yuhan Liu +16Process-Level SupervisionLarge Reasoning Models

  28. Automated Testing of LLM-Based Post Hoc Explainers Using Model Checking as an Oracle

    Aug 31, 2026Dennis Gross, Helge SpiekerProbabilistic Model CheckingExplainable AI Methods

  29. MI-Distillation: Selecting from Model-Interpolated Instruct-Reasoning Data Spectrum for Chain-of-Thought Distillation

    Aug 30, 2026Yangsong Lan, Renkai Hu, HongKai Zheng +4Dataset DistillationLarge Reasoning Models

  30. JPO: Juris Policy Optimization for Structured Legal Reasoning in Criminal Judgment Prediction

    Aug 30, 2026Zhaolu Kang, Yantao Liu, Tailong Luo +14Legal Reasoning TasksLarge Reasoning Models

  31. Chain-of-Thought Faithfulness of Reasoning Models Varies with Where and How Preference Cues Are Delivered

    Aug 29, 2026Aryo Pradipta Gema, Neel Rajani, Rohit Saxena +2Explanation FaithfulnessLarge Reasoning Models

  32. ERR+: Sequential Entropy Resolution for Efficient and Decisive LLM Reasoning

    Aug 28, 2026Xin Jiang, Minhao Wang, Wen Wu +4LLM Reasoning StrategiesLarge Reasoning Models

  33. ThinkRetrieve: Retrieval-Augmented Reasoning Traces for Test-Time Scaling

    Aug 11, 2026Vaibhav Singh, Soumya Suvra Ghosal, Sarvesh Gharat +3Test-Time ScalingLarge Reasoning Models

  34. BDH-CQ: In-Context Learning with Recurrent Latent Reasoning

    Aug 10, 2026Björn Engdahl, Adrian Kosowski, Jan Chorowski +6Efficient Latent ReasoningLarge Reasoning Models

  35. SkillReason: Reasoning-Enhanced Agent Skill Retrieval for Implicit User Requests

    Aug 9, 2026Donghong Jiang, Endian Lin, Luoping Cui +6Agent Skill RetrievalSkills

  36. Thought-Level Beam Search for Reasoning

    Aug 8, 2026Lijie Yang, Hongyin Luo, Jiawei Zhao +2Large Reasoning ModelsBeam Search

  37. Thinking Hard, Not Smart: Reasoning Models Fail to Ration Test-Time Compute Across Questions

    Aug 8, 2026Chenrui Fan, Yize Cheng, Ming Li +3Large Reasoning ModelsTest Time

  38. REIN: Bridging the Gap between Reasoning and Reliability via Reflection and Abstention Alignment

    Aug 8, 2026Zhengze Huang, Luyang Yu, Di Hong +5Large Reasoning ModelsAbstention

  39. ReCBM: Uncertainty-Gated Relational Reasoning for Concept Bottleneck Models

    Aug 7, 2026An Sui, Yuzhu Li, Fuping Wu +1Concept Bottleneck ModelsUncertainty-Aware Classification

  40. Easy to Complete, Hard to Choose: Investigating LLM Performance on the ProverbIT Benchmark

    Aug 5, 2026Enrico Mensa, Lorenzo Zane, Calogero Jerik Scozzaro +3LLM Reasoning StrategiesMetaphors

  41. Evaluating Theory of Mind in Reasoning Models: Robustness over Reasoning

    Aug 5, 2026Ian B. de Haan, Peter van der Putten, Max van DuijnLarge Reasoning ModelsTheory

  42. PAMT: Process-Aligned Reinforcement Learning for Multi-Domain Machine Translation

    Aug 4, 2026Yongshi Ye, Biao Fu, Chongxuan Huang +2Machine TranslationDomain-Adapted Diffusion

  43. Recursive Vision Language Models for General Symbolic Reasoning

    Aug 2, 2026Omid Nejati Manzari, Guillaume Lajoie, Hassan RivazLarge Reasoning ModelsQwen3

  44. Beyond Routing Weights: Faithful Response-Level Interpretation of Mixture-of-Experts Reward Models via Contribution Contrast

    Jul 31, 2026Yifan Wang, Jinyi Mu, Mayank Jobanputra +4Progress Reward ModelingExpert Demonstrations