Best-of-N Sampling

Momentum

2 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 22

All topics
CardsList
  1. Efficient Best-of-N policy evaluation for inference-time alignment

    Oct 7, 2026Jonas Schweisthal, Yuxin Wang, Athiya Deviyani +2Best-of-N SamplingOff-Policy Evaluation

  2. Efficient Reasoning Exploration via State-Conditioned Latent Steering with Progress Guidance

    Sep 21, 2026Hengyuan Zhang, Chenming Shang, Zunhai Su +10Best-of-N SamplingInference-Time Guidance

  3. Evaluator Ensembles Under Reward Hacking: Covariance Geometry and Finite-Search Guarantees

    Aug 8, 2026Fariya Afrin, Ibne Farabi ShihabReward HackingLLM Evaluation

  4. Best-of-Evidence: Best-of-N Selection under Partial Verification

    Jul 23, 2026Cenwei Zhang, Teng Fang, Yuxia Wang +3Model SelectionEvidence-Grounded Reasoning

  5. Flash-BoN: Instant Drafts for Inference-Time Scaling in Diffusion Models

    Jul 5, 2026Ruchit Rawal, Reza Shirkavand, Sayak Paul +5Inference-Time ScalingBest-of-N Sampling

  6. Best-of-Better-NN: Generating Pre-Aligned Responses with In-Context Learning

    Jul 3, 2026Eric Lei, Hsiang Hsu, Chun-Fu ChenLLM AlignmentBest-of-N Sampling

  7. When More Sampling Hurts: The Modal Ceiling and Correlation Ceiling of Test-Time Scaling

    Jun 27, 2026Yong Yi Bay, Kathleen A. YearickLLM EvaluationSelf-Consistency Decoding

  8. Transition-Aware best-of-N sampling for Longitudinal Chest X-ray Reports

    Jun 23, 2026Halil Ibrahim Gulluk, Max Van Puyvelde, Wim Van Criekinge +1Radiology Report GenerationRadiology VLMs

  9. Predicting Inference-Time Scaling Gains from Labeled Validation-Set Output Statistics

    Jun 2, 2026Luyang Zhang, Jingyan LiLLM EvaluationInference-Time Scaling

  10. Reward Learning from Best-of-NN Preference Data: Targets, Tradeoffs, and Design Principles

    May 28, 2026Rattana Pukdee, Maria-Florina Balcan, Pradeep RavikumarPairwise Preference LearningReward Modeling

  11. CCS: Clinical Consensus Selection for Radiology Report Generation

    May 28, 2026Xi Zhang, Yingshu Li, Zaiqiao Meng +2Radiology Report GenerationRadiology VLMs

  12. What should post-training optimize? A test-time scaling law perspective

    May 11, 2026Muheng Li, Jian Qian, Wenlong MouTest-Time ScalingBest-of-N Sampling

  13. On-Policy Distillation with Best-of-N Teacher Rollout Selection

    May 10, 2026Ke Zhang, Yunjie Tian, Dongdi Zhao +4CoT DistillationBest-of-N Sampling

  14. Flexible Empowerment at Reasoning with Extended Best-of-N Sampling

    Apr 17, 2026Taisuke KobayashiReinforcement LearningBest-of-N Sampling

  15. SCATR: Simple Calibrated Test-Time Ranking

    Apr 16, 2026Divya Shyamal, Marta Knežević, Lan Tran +3Test-Time ScalingBest-of-N Sampling

  16. Do not be greedy, Think Twice: Sampling and Selection for Document-level Information Extraction

    Jan 26, 2026Mikel Zubillaga, Oscar Sainz, Oier Lopez de Lacalle +1Self-Consistency DecodingDocument Information Extraction

  17. PiCSAR: Probabilistic Confidence Selection And Ranking for Reasoning Chains

    Aug 29, 2025Joshua Ong Jun Leang, Zheng Zhao, Aryo Pradipta Gema +7Confidence Estimation in Language ModelsBest-of-N Sampling