Inference-Time Scaling

Latest papers 77

All topics
CardsList
  1. Expanding LLM Reasoning

    Oct 4, 2026Rian Atri, Evan LuoLLM Inference EfficiencyInference-Time Scaling

  2. Error-Corrected Inference-Time Scaling for Imperfect Diffusion Models

    Oct 1, 2026Zuokai Wen, Louis Grenioux, Weinan E +1Markov Chain Monte CarloDiffusion Model Sampling

  3. Scaling Laws for Looped Mixture of Experts

    Sep 30, 2026Yanbei Chen, Anirudh Goyal, Raghuraman KrishnamoorthiMixture-of-Experts Language ModelsLanguage Model Scaling Laws

  4. Hermes: Learning Contextual Reasoning Unlocks Test-Time Scaling

    Sep 29, 2026Xinyu Li, Mononito Goswami, Hao Liu +5LLM InferenceInference-Time Scaling

  5. Port-Hamiltonian Latent Deliberation: Mitigating the Deliberation Drift Cliff in Test-Time Compute Scaling

    Sep 29, 2026Zeyu JiaHodge DecompositionInference-Time Scaling

  6. From Search to Research: Exploring Search Scaling in Autonomous Quantitative Factor Mining

    Sep 28, 2026Kangcheng Deng, Hui Cai, Jiacheng Lu +6Inference-Time ScalingAutonomous Research Agents

  7. Long-Horizon Scaling: How Model Capabilities Shape the Returns to Computation

    Sep 28, 2026Haoyu Zheng, Zhengyu Chen, Huaisheng Zhu +5Cost-Aware InferenceInference-Time Scaling

  8. Scaling of Capability and Efficiency at Inference Time in Large Reasoning Models

    Sep 22, 2026Moritz Laber, Zohair Shafi, Germans Savcisens +6LLM Inference EfficiencyLanguage Model Scaling Laws

  9. The Organization of Inference: Information, Resource Constraints, and AI Production

    Sep 17, 2026Yukun Zhang, Kemu Xu, Yishen ChenLLM PlanningInference-Time Scaling

  10. Right Direction, Wrong Step: Geometric Analysis of Finite-Step Failure in Looped Transformers

    Sep 15, 2026Zhihao Guo, Zonghan Wu, Haizhou Du +4Inference-Time ScalingRecurrent Transformers

  11. A Survey on Self-Improving Test-Time Intelligence: Feedback-Driven Adapting, Learning, and Scaling at Inference

    Sep 1, 2026Shuaicheng Niu, Guohao Chen, Yaofo Chen +14Test-Time AdaptationInference-Time Scaling

  12. Escaping Reasoning Basin Collapse with History-Biased Search

    Sep 1, 2026Lu ChengInference-Time SearchReasoning Diversity

  13. When LLM Meets Tree Search: A Systematic View of Inference as Search in Large Language Models

    Aug 31, 2026Jiaqi Wei, Xiang Zhang, Yuejin Yang +10Inference-Time SearchInference-Time Scaling

  14. Reactivating Test-Time Scaling for Plane Geometry Problem Solving

    Aug 31, 2026Xiaoqiang Kang, Shengen Wu, Maizhen Ning +5Spatial Reasoning BenchmarksInference-Time Scaling

  15. Who Thinks Best Depends on How Long You Let Them: Budget-Dependent Rankings in LLM Evaluation

    Aug 12, 2026Rodrigo Guedes de Souza, Alison R. PanissonLLM EvaluationLanguage Model Generation Evaluation

  16. Bridging Inference-Time Scaling and Episodic Memory with Action-Centric Graphs

    Jul 29, 2026Xu Zheng, Chaohao Lin, Zhuomin Chen +4Agent MemoryInference-Time Search

  17. Inference-Time Scaling of Diffusion Models via Progressive Seed Pruning

    Jul 23, 2026Rogerio Guimaraes, Pietro PeronaDiffusion Model SamplingDiffusion Sampling

  18. Flash-BoN: Instant Drafts for Inference-Time Scaling in Diffusion Models

    Jul 5, 2026Ruchit Rawal, Reza Shirkavand, Sayak Paul +5Inference-Time ScalingBest-of-N Sampling

  19. QuasiMoTTo: Quasi-Monte Carlo Test-Time Scaling

    Jul 1, 2026Michael Y. Li, Anthony Zhan, Kanishk Gandhi +2Inference-Time ScalingSample-Efficient RL

  20. Message Passing Enables Efficient Reasoning

    Jul 1, 2026Xuecheng Liu, Daman Arora, Gokul Swamy +1Inference-Time ScalingEfficient Language Model Reasoning

  21. Active Inference as the Test-Time Scaling Law for Physical AI Agents

    Jun 22, 2026Omar Hashash, Christo Kurisummoottil Thomas, Walid Saad +3Active InferenceInference-Time Scaling

  22. How Inference Compute Shapes Frontier LLM Evaluation

    Jun 16, 2026Jessica McFadyen, Ole Jorgensen, Harry Coppock +2LLM EvaluationLanguage Model Generation Evaluation

  23. Entropy-Gated Latent Recursion

    Jun 15, 2026Soham Bhattacharjee, Dushyant Singh Chauhan, Salem Lahlou +2LLM InferenceInference-Time Scaling

  24. Adaptive Inference-Time Scaling via Early-Step Latent Verification for Image Editing

    Jun 13, 2026Yue Yu, Yang Jiao, Jiayu Wang +2Inference-Time ScalingDiffusion-Based Image Editing

  25. MaxProof: Scaling Mathematical Proof with Generative-Verifier RL and Population-Level Test-Time Scaling

    Jun 11, 2026Jiacheng Chen, Xinyu Zhang, Shunkai Zhang +20Automated Theorem ProvingInference-Time Scaling

  26. DIRECT: When and Where Should You Allocate Test-Time Compute in Embodied Planners?

    Jun 10, 2026Jadelynn Dao, Milan Ganai, Yasmina Abukhadra +7Test-Time Scaling for VLMsInference-Time Scaling

  27. Pushing the Limits of LLM Tool Calling via Experiential Knowledge Integration and Activation

    Jun 9, 2026Yupu Hao, Zhuoran Jin, Huanxuan Liao +2Knowledge Augmentation for Language ModelsInference-Time Scaling

  28. Intrinsic Selection and Particle Resampling for Inference-Time Scaling Beyond Domain Verifiability

    Jun 7, 2026Giorgio Giannone, Mustafa Eyceoz, Shabana Baig +5Particle FilteringInference-Time Scaling

  29. Sample Where You Struggle: Sharpening Base Model Reasoning via Entropy-Guided Power Sampling

    Jun 7, 2026Hong Guo, Nianhui Guo, Christoph Meinel +1Markov Chain Monte CarloInference-Time Scaling

  30. Test-Time Compute Scaling for ASR with Depth-Conditioned Looped Transformers

    Jun 3, 2026Yacouba Kaloga, Shashi Kumar, Shakeel A. Sheikh +3Inference-Time ScalingTest-Time Scaling

  31. Inference-Time Scaling for Joint Audio-Video Generation

    Jun 2, 2026Jaemin Jung, Kyeongha Rho, Inkyu Shin +1Audio-Video GenerationInference-Time Scaling

  32. The Shadow Price of Reasoning: Economic Perspective on Optimal Budget Allocation for LLMs

    Jun 2, 2026Xu Wan, Speed Zhu, Jianwei Cai +4Cost-Aware InferenceInference-Time Scaling

  33. Predicting Inference-Time Scaling Gains from Labeled Validation-Set Output Statistics

    Jun 2, 2026Luyang Zhang, Jingyan LiLLM EvaluationInference-Time Scaling

  34. UniScale: Adaptive Unified Inference Scaling via Online Joint Optimization of Model Routing and Test-Time Scaling

    May 29, 2026Kaiyu Huang, Xingyu Wang, Mingze Kong +6Cost-Aware InferenceInference-Time Scaling

  35. Scaling Laws for Agent Harnesses via Effective Feedback Compute

    May 28, 2026Xuanliang Zhang, Dingzirui Wang, Keyan Xu +2Inference-Time ScalingAgent Harness Optimization

  36. Extrapolative Weight Averaging Reveals Correctness-Efficiency Frontiers in Code RL

    May 27, 2026Kunhao Zheng, Pierre Chambon, Juliette Decugis +4Multi-Objective Reinforcement LearningRL for Code Generation

  37. RAS: Reflection-Augmented Scaling with In-Context Learning for Executable Cypher Query Generation

    May 21, 2026Minseok Jung, Abhas Ricky, Muhammad Rameez ChatniExecution-Guided Code GenerationInference-Time Scaling

  38. Inference-Time Scaling in Diffusion Models through Iterative Partial Refinement

    May 19, 2026Taegu Kang, Jaesik Yoon, Sungjin AhnInference-Time ScalingDiffusion Models

  39. Simple Approximation and Derivative Free Inference-Time Scaling for Diffusion Models via Sequential Monte Carlo on Path Measures

    May 18, 2026Chenyang Wang, Weizhong Wang, Yinuo Ren +2Diffusion Model GuidanceImportance Sampling

  40. Drift Flow Matching

    May 17, 2026Chenrui Ma, Xi Xiao, Lin Zhao +3Flow MatchingInference-Time Scaling

  41. Effort as Ceiling, Not Dial: Reasoning Budget Does Not Modulate Cognitive Cost Alignment Between Humans and Large Reasoning Models

    May 16, 2026Yueqing Hu, Tianhong WangComputational Cognitive ModelingInference-Time Scaling

  42. Inference-Time Amplification of Weak Reasoning Models

    May 13, 2026Varun Sunkaraneni, Pierfrancesco Beneventano, Riccardo Neumarker +2Inference-Time ScalingLLM Reasoning

  43. TabPFN-3: Technical Report

    May 13, 2026Léo Grinsztajn, Klemens Flöge, Oscar Key +38Tabular Foundation ModelsEfficient Neural Network Inference

  44. Drift is a Sampling Error: SNR-Aware Power Distributions for Long-Horizon Robotic Planning

    May 10, 2026Kewei Chen, Yayu Long, Mingsheng ShangRobotic ControlInference-Time Scaling

  45. Sketch-and-Verify: Structured Inference-Time Scaling via Program Sketching

    May 9, 2026Shan Jiang, Zijian Yi, Chenguang ZhuLLM Inference EfficiencyTest-Time Optimization