Inference-Time Scaling

Latest papers 77

All topics
CardsList
  1. Active Inference as the Test-Time Scaling Law for Physical AI Agents

    Jun 22, 2026Omar Hashash, Christo Kurisummoottil Thomas, Walid Saad +3Active InferenceInference-Time Scaling

  2. How Inference Compute Shapes Frontier LLM Evaluation

    Jun 16, 2026Jessica McFadyen, Ole Jorgensen, Harry Coppock +2LLM EvaluationLanguage Model Generation Evaluation

  3. Entropy-Gated Latent Recursion

    Jun 15, 2026Soham Bhattacharjee, Dushyant Singh Chauhan, Salem Lahlou +2LLM InferenceInference-Time Scaling

  4. Adaptive Inference-Time Scaling via Early-Step Latent Verification for Image Editing

    Jun 13, 2026Yue Yu, Yang Jiao, Jiayu Wang +2Inference-Time ScalingDiffusion-Based Image Editing

  5. MaxProof: Scaling Mathematical Proof with Generative-Verifier RL and Population-Level Test-Time Scaling

    Jun 11, 2026Jiacheng Chen, Xinyu Zhang, Shunkai Zhang +20Automated Theorem ProvingInference-Time Scaling

  6. DIRECT: When and Where Should You Allocate Test-Time Compute in Embodied Planners?

    Jun 10, 2026Jadelynn Dao, Milan Ganai, Yasmina Abukhadra +7Test-Time Scaling for VLMsInference-Time Scaling

  7. Pushing the Limits of LLM Tool Calling via Experiential Knowledge Integration and Activation

    Jun 9, 2026Yupu Hao, Zhuoran Jin, Huanxuan Liao +2Knowledge Augmentation for Language ModelsInference-Time Scaling

  8. Intrinsic Selection and Particle Resampling for Inference-Time Scaling Beyond Domain Verifiability

    Jun 7, 2026Giorgio Giannone, Mustafa Eyceoz, Shabana Baig +5Particle FilteringInference-Time Scaling

  9. Sample Where You Struggle: Sharpening Base Model Reasoning via Entropy-Guided Power Sampling

    Jun 7, 2026Hong Guo, Nianhui Guo, Christoph Meinel +1Markov Chain Monte CarloInference-Time Scaling

  10. Test-Time Compute Scaling for ASR with Depth-Conditioned Looped Transformers

    Jun 3, 2026Yacouba Kaloga, Shashi Kumar, Shakeel A. Sheikh +3Inference-Time ScalingTest-Time Scaling

  11. Inference-Time Scaling for Joint Audio-Video Generation

    Jun 2, 2026Jaemin Jung, Kyeongha Rho, Inkyu Shin +1Audio-Video GenerationInference-Time Scaling

  12. The Shadow Price of Reasoning: Economic Perspective on Optimal Budget Allocation for LLMs

    Jun 2, 2026Xu Wan, Speed Zhu, Jianwei Cai +4Cost-Aware InferenceInference-Time Scaling

  13. Predicting Inference-Time Scaling Gains from Labeled Validation-Set Output Statistics

    Jun 2, 2026Luyang Zhang, Jingyan LiLLM EvaluationInference-Time Scaling

  14. UniScale: Adaptive Unified Inference Scaling via Online Joint Optimization of Model Routing and Test-Time Scaling

    May 29, 2026Kaiyu Huang, Xingyu Wang, Mingze Kong +6Cost-Aware InferenceInference-Time Scaling

  15. Scaling Laws for Agent Harnesses via Effective Feedback Compute

    May 28, 2026Xuanliang Zhang, Dingzirui Wang, Keyan Xu +2Inference-Time ScalingAgent Harness Optimization

  16. Extrapolative Weight Averaging Reveals Correctness-Efficiency Frontiers in Code RL

    May 27, 2026Kunhao Zheng, Pierre Chambon, Juliette Decugis +4Multi-Objective Reinforcement LearningRL for Code Generation

  17. RAS: Reflection-Augmented Scaling with In-Context Learning for Executable Cypher Query Generation

    May 21, 2026Minseok Jung, Abhas Ricky, Muhammad Rameez ChatniExecution-Guided Code GenerationInference-Time Scaling

  18. Inference-Time Scaling in Diffusion Models through Iterative Partial Refinement

    May 19, 2026Taegu Kang, Jaesik Yoon, Sungjin AhnInference-Time ScalingDiffusion Models

  19. Simple Approximation and Derivative Free Inference-Time Scaling for Diffusion Models via Sequential Monte Carlo on Path Measures

    May 18, 2026Chenyang Wang, Weizhong Wang, Yinuo Ren +2Diffusion Model GuidanceImportance Sampling

  20. Drift Flow Matching

    May 17, 2026Chenrui Ma, Xi Xiao, Lin Zhao +3Flow MatchingInference-Time Scaling

  21. Effort as Ceiling, Not Dial: Reasoning Budget Does Not Modulate Cognitive Cost Alignment Between Humans and Large Reasoning Models

    May 16, 2026Yueqing Hu, Tianhong WangComputational Cognitive ModelingInference-Time Scaling

  22. Inference-Time Amplification of Weak Reasoning Models

    May 13, 2026Varun Sunkaraneni, Pierfrancesco Beneventano, Riccardo Neumarker +2Inference-Time ScalingLLM Reasoning

  23. TabPFN-3: Technical Report

    May 13, 2026Léo Grinsztajn, Klemens Flöge, Oscar Key +38Tabular Foundation ModelsEfficient Neural Network Inference

  24. Drift is a Sampling Error: SNR-Aware Power Distributions for Long-Horizon Robotic Planning

    May 10, 2026Kewei Chen, Yayu Long, Mingsheng ShangRobotic ControlInference-Time Scaling

  25. Sketch-and-Verify: Structured Inference-Time Scaling via Program Sketching

    May 9, 2026Shan Jiang, Zijian Yi, Chenguang ZhuLLM Inference EfficiencyTest-Time Optimization