Test Time

Momentum

24 papers in the last four weeks, up 500% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 134

All topics
CardsList
  1. How Much Can Language Models Gain from Test-Time Computation?

    Oct 1, 2026Bangji Yang, Jingyuan Li, Jiajun Fan +8Test TimeSelf

  2. Improving Predicted MOS Scores, Not Perceived Quality: Multi-Predictor Test-Time Optimization of Enhanced Speech

    Sep 30, 2026Tsubasa Ochiai, Marc Delcroix, Nahomi Kusunoki +5Mean Opinion ScoresSpeech Enhancement

  3. Composing Task-specific Agent Harnesses at Test Time with Reusable Primitives

    Sep 30, 2026Peng Kuang, Haibo Jin, Dehao Wu +4Agent HarnessTest Time

  4. Budget Boundary Effects in Test-Time Mathematical Reasoning

    Sep 30, 2026Guilin Zhang, Ziqi Tan, Wulan Guo +5Mathematical ReasoningTest Time

  5. Port-Hamiltonian Latent Deliberation: Mitigating the Deliberation Drift Cliff in Test-Time Compute Scaling

    Sep 29, 2026Zeyu JiaTest-Time ScalingEfficient Latent Reasoning

  6. UpliftMem: Learning Set-Level Uplift for Agent Memory Retrieval

    Sep 29, 2026Mengkun Liang, Haoran Qiang, Guannan Liu +1RiseTest Time

  7. T2^2Mem: Learning Test-Time Memory for Robotics

    Sep 29, 2026Yize Liu, Huang Huang, Yining Hong +4Robotic ManipulationTest Time

  8. Test-Time Adaptation of Manipulation Policies Under Actuator Degradation

    Sep 28, 2026Som Sagar, Ransalu SenanayakeActuatorGoal-Conditioned Value Function

  9. Scouting the Dynamics Gap: Test-Time Policy Adaptation via Action-Outcome Feedback

    Sep 28, 2026Yishu Li, Liyuan Geng, Xinyi Mao +2Robot PoliciesMeta-Learning

  10. Transferable Mass Spectrum Prediction via Reference-Guided Test-time Specialization

    Sep 28, 2026Yunhua Zhong, Runting Li, Yifan Li +5Tandem Mass SpectraMetabolic

  11. Backdoor as Probe: Test-Time Adversarial Defense for CLIP

    Sep 28, 2026Zhongqi Wang, Jie Zhang, Nie Sen +3Test Time

  12. FlexLoop: Depth-Elastic Looped Policies for Adaptive Test-Time Computation in Deep RL

    Sep 28, 2026Xun Wang, Ruishuo Chen, Yu Chen +2Offline Reinforcement LearningLoop

  13. JET: Judge-Guided Evolution at Test Time for Agent Programs

    Sep 28, 2026Yao Long Teng, Jiayi Cai, Bo AnEvolutionary Optimization MethodsTest Time

  14. Planned Test-Time Scaling with Coordinated Reasoning Paths

    Sep 23, 2026Xueqing Wu, Langxing Bai, Hritik Bansal +5Test-Time ScalingTest Time

  15. Beyond Visual Quality: A Study of Test-Time Planning with World Action Models

    Sep 21, 2026Jianhao Yuan, Yu Yuan, Benjamin Ramtoula +5Action SelectionWorld Model Planning

  16. Confidence-Gated Transductive Test Generation for Code Reranking

    Sep 14, 2026Sungjae Lee, Youngsik Yoon, Seockbean Song +3Test GenerationTest Time

  17. Amortized Low-Rank Adaptation for Model-Based Reinforcement Learning

    Sep 10, 2026Fernando Palafox, David Fridovich-KeilModel-Based Reinforcement LearningIn-Context Learning

  18. Rethinking Indirect Prompt Injection as a Test-Time Search Problem

    Sep 7, 2026Duong M. Nguyen, Joon Sik Kim, Blazej Manczak +1Indirect Prompt InjectionCyberattacks

  19. HSRM: Hidden-State Reward Models for Test-Time Verification

    Aug 31, 2026Xianzhi Li, Xiaodan ZhuMathematical ReasoningTest Time

  20. Claim-Level Reliability Assessment for Efficient Test-Time Reasoning

    Aug 12, 2026Sen Xu, Wei Wang, Shixi Liu +5FalsehoodTest Time

  21. Consilience for Verifier-Free Test-Time Scaling

    Aug 10, 2026Lecheng Kong, Like Hui, Haitao Mao +1Test-Time ScalingTest Time

  22. Efficient Test-Time Scaling for LLM-based Time Series Forecasting

    Aug 9, 2026Xuan-May Le, Minh-Tuan Tran, Ling Luo +3Time Series ForecastingLarge Language Model Forecasting

  23. Forgotten History or Test-of-Time? Retrospect and Prospect on RAG from an IR Perspective

    Aug 9, 2026Xiaoyan Zhao, Yujie Cai, Yang Zhang +2HistoryTest Time

  24. Thought-Level Beam Search for Reasoning

    Aug 8, 2026Lijie Yang, Hongyin Luo, Jiawei Zhao +2Large Reasoning ModelsBeam Search

  25. Thinking Hard, Not Smart: Reasoning Models Fail to Ration Test-Time Compute Across Questions

    Aug 8, 2026Chenrui Fan, Yize Cheng, Ming Li +3Large Reasoning ModelsTest Time

  26. CoBa: Cost-Effective Test-Time Scaling via Compute-Balanced Routing

    Aug 7, 2026Yan Zhou, Yue Ouyang, Kaiyang Zheng +1Test-Time ScalingTest Time

  27. Refining Over Resampling: Test-Time Self-Correction for LLM Reasoning

    Aug 6, 2026Ahsan Bilal, Muhammad Ahmed Mohsin, Muhammad Umer +4LLM Reasoning StrategiesTest Time

  28. Consistency-Driven Co-Evolution for Self-Supervised Cross-Representation Learning

    Aug 5, 2026Xuehang Guo, Pengyuan Li, Tom Hope +3Self-Supervised RepresentationsImage-To-Code Generation

  29. Interpretable Adaptive Sampling for LLM Test-Time Scaling

    Aug 4, 2026Mobina Kashaniyan, Ali JannesariTest-Time ScalingTest Time

  30. Aligning Large Vision-Language Models at Test Time: A Trajectory-Guided Structured Sampling Approach

    Aug 4, 2026Tianbao Jiang, Weicong Ni, Gerard de Melo +1Visual ReasoningTest Time

  31. It's the Decoding Format, Not the Perturbation: Auditing Consistency-Based Selection for Vision-Language Test-Time Scaling

    Aug 2, 2026Puzhuo Zheng, Hasan KurbanTextvqaTest Time

  32. PeCA: Palette Context Assisted Inference for Test-Time Paint-Bucket Colourisation on Animation Videos

    Aug 2, 2026Dongheng Lin, Jianbo JiaoCanvasPixelloop

  33. SVR: Self-Verifying Refinement via Joint Verdict-Confidence Reinforcement Learning for Adaptive Test-Time Compute

    Jul 30, 2026Hongyu Chen, Liang Lin, Guangrun WangReinforcement Learning With Verifiable RewardTest Time

  34. Eviction as Estimation: A Fixed-Lag Smoothing View of Test-Time Memory, and When Measuring Beats Accumulating

    Jul 27, 2026Maruthi Vemula, Neeraj Praneeth GajulaWorking MemoryEviction

  35. CachedSearch: Training-Free Cached Exploration for Test-Time Search in Video Diffusion

    Jul 25, 2026Shreshth Saini, Neil Birkbeck, Yilin Wang +2Video Diffusion ModelsTest Time

  36. Test-Time Registers as Global Priors for Tokenized Image Generation

    Jul 18, 2026Cheng-Yao Hong, Yifan Wang, Yuewei Lin +1Visual TokenizersSingle-Cell Foundation Models

  37. EXPLORE: Exploration with Guided Search for Analog Topology Generation using Language Models

    Jul 15, 2026Guanglei Zhou, Chen-Chia Chang, Yikang Shen +5Analog DesignCommunication Topologies

  38. Interaction Scaling: Grounding the Third Axis of Test-Time Compute

    Jul 13, 2026Bojie Li, Noah ShiTest-Time ScalingTest Time

  39. Efficient Test-Time Optimization for Multi-Agent Proof Autoformalization

    Jul 13, 2026Tian-Shuo Liu, Shiyuan Zhang, Zijie Geng +5AutoformalizationTheorem Proving

  40. PriGo: Test-Time Primitive Guidance to Diffusion and Flow Policies for Adaptive Robotic Manipulation

    Jul 8, 2026Zezeng Li, Enda Xiang, Thuy Tran +3Robotic ManipulationImitation Learning

  41. WAM-TTT: Steering World-Action Models by Watching Human Play at Test Time

    Jul 8, 2026Yusen Feng, Bingchen Han, Jiangran Lyu +13Efficient World-Action ModelWorld Models

  42. Cost-Effective Agent Harnesses for Abstract Reasoning and Generalization on ARC-AGI-1

    Jul 7, 2026Kabir Moghe, Peter ChinAgentic ReasoningTest Time

  43. DART-VLN: Test-Time Memory Decay and Anti-Loop Regularization for Discrete Vision-Language Navigation

    Jul 1, 2026Shaoheng Zhang, Zhichen Li, Jie MeiVision-Language NavigationFrozen Vision-Language Models

  44. Selective Test-Time Debiasing for CLIP via Reward Gating

    Jul 1, 2026Jaeho Han, Jisoo Yang, Hyeondong Woo +3Vision-Language Model AdaptationZero-Shot Robustness

  45. Test-Time Verification for Text-to-SQL via Outcome Reward Models

    Jun 29, 2026Mattia Tritto, Giuseppe Farano, Dario Di Palma +4Text-To-SqlTest Time

  46. ReGuide: From Test-Time Guidance to Self-Improving Diffusion Policies

    Jun 27, 2026Tzu-Hsiang Lin, Srinivas Shakkottai, Dileep Kalathil +1Diffusion PoliciesGuidance