Inference-Time Scaling

Latest papers 77

All topics
CardsList
  1. Expanding LLM Reasoning

    Oct 4, 2026Rian Atri, Evan LuoLLM Inference EfficiencyInference-Time Scaling

  2. Error-Corrected Inference-Time Scaling for Imperfect Diffusion Models

    Oct 1, 2026Zuokai Wen, Louis Grenioux, Weinan E +1Markov Chain Monte CarloDiffusion Model Sampling

  3. Scaling Laws for Looped Mixture of Experts

    Sep 30, 2026Yanbei Chen, Anirudh Goyal, Raghuraman KrishnamoorthiMixture-of-Experts Language ModelsLanguage Model Scaling Laws

  4. Hermes: Learning Contextual Reasoning Unlocks Test-Time Scaling

    Sep 29, 2026Xinyu Li, Mononito Goswami, Hao Liu +5LLM InferenceInference-Time Scaling

  5. Port-Hamiltonian Latent Deliberation: Mitigating the Deliberation Drift Cliff in Test-Time Compute Scaling

    Sep 29, 2026Zeyu JiaHodge DecompositionInference-Time Scaling

  6. From Search to Research: Exploring Search Scaling in Autonomous Quantitative Factor Mining

    Sep 28, 2026Kangcheng Deng, Hui Cai, Jiacheng Lu +6Inference-Time ScalingAutonomous Research Agents

  7. Long-Horizon Scaling: How Model Capabilities Shape the Returns to Computation

    Sep 28, 2026Haoyu Zheng, Zhengyu Chen, Huaisheng Zhu +5Cost-Aware InferenceInference-Time Scaling

  8. Scaling of Capability and Efficiency at Inference Time in Large Reasoning Models

    Sep 22, 2026Moritz Laber, Zohair Shafi, Germans Savcisens +6LLM Inference EfficiencyLanguage Model Scaling Laws

  9. The Organization of Inference: Information, Resource Constraints, and AI Production

    Sep 17, 2026Yukun Zhang, Kemu Xu, Yishen ChenLLM PlanningInference-Time Scaling

  10. Right Direction, Wrong Step: Geometric Analysis of Finite-Step Failure in Looped Transformers

    Sep 15, 2026Zhihao Guo, Zonghan Wu, Haizhou Du +4Inference-Time ScalingRecurrent Transformers

  11. A Survey on Self-Improving Test-Time Intelligence: Feedback-Driven Adapting, Learning, and Scaling at Inference

    Sep 1, 2026Shuaicheng Niu, Guohao Chen, Yaofo Chen +14Test-Time AdaptationInference-Time Scaling

  12. Escaping Reasoning Basin Collapse with History-Biased Search

    Sep 1, 2026Lu ChengInference-Time SearchReasoning Diversity

  13. When LLM Meets Tree Search: A Systematic View of Inference as Search in Large Language Models

    Aug 31, 2026Jiaqi Wei, Xiang Zhang, Yuejin Yang +10Inference-Time SearchInference-Time Scaling

  14. Reactivating Test-Time Scaling for Plane Geometry Problem Solving

    Aug 31, 2026Xiaoqiang Kang, Shengen Wu, Maizhen Ning +5Spatial Reasoning BenchmarksInference-Time Scaling

  15. Who Thinks Best Depends on How Long You Let Them: Budget-Dependent Rankings in LLM Evaluation

    Aug 12, 2026Rodrigo Guedes de Souza, Alison R. PanissonLLM EvaluationLanguage Model Generation Evaluation

  16. Bridging Inference-Time Scaling and Episodic Memory with Action-Centric Graphs

    Jul 29, 2026Xu Zheng, Chaohao Lin, Zhuomin Chen +4Agent MemoryInference-Time Search

  17. Inference-Time Scaling of Diffusion Models via Progressive Seed Pruning

    Jul 23, 2026Rogerio Guimaraes, Pietro PeronaDiffusion Model SamplingDiffusion Sampling

  18. Flash-BoN: Instant Drafts for Inference-Time Scaling in Diffusion Models

    Jul 5, 2026Ruchit Rawal, Reza Shirkavand, Sayak Paul +5Inference-Time ScalingBest-of-N Sampling

  19. QuasiMoTTo: Quasi-Monte Carlo Test-Time Scaling

    Jul 1, 2026Michael Y. Li, Anthony Zhan, Kanishk Gandhi +2Inference-Time ScalingSample-Efficient RL

  20. Message Passing Enables Efficient Reasoning

    Jul 1, 2026Xuecheng Liu, Daman Arora, Gokul Swamy +1Inference-Time ScalingEfficient Language Model Reasoning