Test Time

Momentum

24 papers in the last four weeks, up 500% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 134

All topics
CardsList
  1. Majority Voting for Code Generation

    Apr 17, 2026Tim Launer, Jonas Hübotter, Marco Bagatella +2Code GenerationMajority Voting

  2. (1D) Ordered Tokens Enable Efficient Test-Time Search

    Apr 16, 2026Zhitong Gao, Parham Rezaei, Ali Cy +7Autoregressive Image GenerationAutoregressive Generation

  3. Scaling Test-Time Compute for Agentic Coding

    Apr 16, 2026Joongwon Kim, Wannan Yang, Kelvin Niu +13Long-Horizon AgentsCoding Agents

  4. From Procedural Skills to Strategy Genes: Towards Experience-Driven Test-Time Evolution

    Apr 16, 2026Junjie Wang, Yiming Ren, Haoyang ZhangAlphaevolveEvolutionary Optimization Methods

  5. Calibrated Test-Time Guidance for Bayesian Inference

    Feb 25, 2026Daniel Geyfman, Felix Draxler, Jan Groeneveld +3PosteriorBayesian Inference

  6. TTSR: Test-Time Self-Evolving via Reflection

    Feb 6, 2026Haoyang He, Zihua Rong, Yunjia Zhao +3Test-Time TrainingTest Time

  7. Test-Time Alignment of Text-to-Image Diffusion Models via Null-Text Embedding Optimisation

    Nov 25, 2025Taehoon Kim, Henry Gouk, Timothy HospedalesDiffusion AlignmentText-To-Image Diffusion Models

  8. FreeFuse: Multi-Subject LoRA Fusion via Adaptive Token-Level Routing at Test Time

    Oct 27, 2025Yaoli Liu, Yao-Xiang Ding, Kun ZhouCross-AttentionToken-Level Uncertainty

  9. Representation-Based Exploration for Language Models: From Test-Time to Post-Training

    Oct 13, 2025Jens Tuyls, Dylan J. Foster, Akshay Krishnamurthy +1Post-TrainingExploration

  10. Monocular Visual Odometry without Calibration or Test-time Optimization

    Oct 2, 2025Vladimir Yugay, Duy-Kien Nguyen, Theo Gevers +2Visual Inertial OdometryCamera Intrinsics

  11. Code Reasoning for Software Engineering Tasks: A Survey and A Call to Action

    Jun 16, 2025Saurabh Pujar, Ira Ceka, Irene Manotas +3Software EngineeringCode Generation

  12. Scaling Evaluation-time Compute with Reasoning Models as Evaluators

    Mar 25, 2025Seungone Kim, Ian Wu, Jinu Lee +8Large Reasoning ModelsTest Time

  13. AgentRM: Enhancing Agent Generalization with Reward Modeling

    Feb 25, 2025Yu Xia, Jingru Fan, Weize Chen +7Large Language Model AgentsReward Functions