Inference-Time

Momentum

17 papers in the last four weeks, down 6% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 208

All topics
CardsList
  1. Error-Corrected Inference-Time Scaling for Imperfect Diffusion Models

    Oct 1, 2026Zuokai Wen, Louis Grenioux, Weinan E +1Diffusion SamplingMonte Carlo

  2. Before It Fades: Reinforcing Temporal Representations at Inference Time in VideoLLMs

    Oct 1, 2026Youngwoo Shin, Yusung Ro, Minseo Kim +1Inference-TimeLayer-Wise

  3. Beyond Memory: Harnessing Long-Horizon Agents with Explicit Belief States

    Oct 1, 2026Yu Luo, Jiamin Jiang, Yimin Zuo +9Long-Horizon AgentsLong-Horizon Task Planning

  4. Hermes: Learning Contextual Reasoning Unlocks Test-Time Scaling

    Sep 29, 2026Xinyu Li, Mononito Goswami, Hao Liu +5Test-Time ScalingInference-Time

  5. HARISSA: Inference-Time Self-Checks for Efficient and Safe Local Language Model Deployment

    Sep 29, 2026Kenan Alkiek, Moontae Lee, David Jurgens +1Inference-TimePrefill

  6. Beam Search as Test-Time Self-Distillation via Counterfactual Contexts

    Sep 29, 2026Su Ee Tan, Xiaotong Ji, Rasul Tutunov +2Self-Distillation FrameworkInference-Time

  7. Fair Fact-Checking: Closing the Cross-Lingual Gap in LLM Factual Judgement with RoSh

    Sep 28, 2026Muhammad Ahmad, Fatemeh Seyedin, Adrian Weller +2Cross-Lingual ConsistencyMisinformation

  8. Steer2Grasp: Inference-Time Embodiment-Aware Steering for Diverse Physically Feasible Grasp Diffusion

    Sep 27, 2026Vignesh Vembar, Ayush Kaura, A Padmaprabhan +5Robotic GraspingInference-Time Steering

  9. Scaling of Capability and Efficiency at Inference Time in Large Reasoning Models

    Sep 22, 2026Moritz Laber, Zohair Shafi, Germans Savcisens +6Large Reasoning ModelsModel Size

  10. LLM Inference in a Flash!

    Sep 14, 2026Sebastian Zhao, Minseo Kim, Coleman Hooper +5LLM Inference OptimizationInference-Time

  11. Can LLMs in Draft-Verify-Revise Pipelines Resolve Deictic Ambiguity?

    Sep 14, 2026Obinna I. EkekezieLarge Language Model WorkflowsAmbiguity

  12. Beyond Training: A Feasibility Taxonomy for Inference-Time AI Governance

    Sep 9, 2026Samar AnsariArtificial Intelligence GovernanceGovernance

  13. Proxy Policy Steering

    Sep 8, 2026Chuanruo Ning, Tianrui Wang, Wei-Chiu Ma +1Robot PoliciesRobot Systems

  14. It's All in the Way You Say It: The Role of Information Representation in LLM-Based Glycemic-Event Prediction

    Sep 8, 2026Andrea Apicella, Pasquale Arpaia, Matteo Orefice +2Continuous Glucose MonitoringLarge Language Model Forecasting

  15. When Quantization Breaks Memory: Recurrent-State Write-Back in Low-Precision Temporal Inference

    Sep 7, 2026Ismail Erbas, Xavier Intes, Vikas PandeyRecurrent StateBackward Passes

  16. Iris: Climbing to the Search Frontier

    Sep 3, 2026Ziyuan Liu, Hengqi Liu, Zichuan Wang +8Search AgentsMulti-Hop Reasoning

  17. Stabilizing Camera-Controlled Novel View Synthesis at Inference Time

    Sep 3, 2026Prajwal Singh, Arjun Badola, Seema Kumari +2Video Diffusion ModelsCamera Control

  18. Diffusion as a Training Curriculum for Timestep-Free Iterative Reasoning

    Sep 1, 2026Mariia Drozdova, Aidan Sirbu, Pietro Miotti +4Functional Code SolversDenoising Diffusion Probabilistic Model

  19. A Survey on Self-Improving Test-Time Intelligence: Feedback-Driven Adapting, Learning, and Scaling at Inference

    Sep 1, 2026Shuaicheng Niu, Guohao Chen, Yaofo Chen +14Test-Time AdaptationTest-Time Training

  20. Escaping Reasoning Basin Collapse with History-Biased Search

    Sep 1, 2026Lu ChengInference-TimeReasoning Paths

  21. Trust Your Guide Only When Certain: Uncertainty-Aware Sparse Alignment at Inference Time

    Sep 1, 2026Zeen Zhu, Zhuo Li, Weiyang Guo +4Distributional AlignmentInference-Time Defense

  22. When LLM Meets Tree Search: A Systematic View of Inference as Search in Large Language Models

    Aug 31, 2026Jiaqi Wei, Xiang Zhang, Yuejin Yang +10Tree SearchLLM Reasoning Strategies

  23. Ouroboros: Self-Referential Backdoor Attacks on Speech Enhancement via Clean Audio Triggers

    Aug 31, 2026Yunjie Zhou, Yuheng Huang, Diqun YanSpeech EnhancementInference-Time

  24. Inference-Time Orthogonal Seeding Enables Geometry-Aligned 3D Organ Segmentation for Slice-Propagation Methods

    Aug 12, 2026Md Rakibul Haque, Tushar Kataria, Shireen Y. Elhabian3D Medical Image SegmentationVoxel

  25. AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses

    Aug 12, 2026Cheng Qian, Wenting Zhao, Liangwei Yang +6Inference-TimeReasoning Benchmark

  26. Measure, Don't Optimize: Forecasting Recovery in LLM Unlearning

    Aug 11, 2026Zirui Song, Huaxing Liu, Xiang Wang +8Large Language Model UnlearningUnlearning Method

  27. ThinkRetrieve: Retrieval-Augmented Reasoning Traces for Test-Time Scaling

    Aug 11, 2026Vaibhav Singh, Soumya Suvra Ghosal, Sarvesh Gharat +3Test-Time ScalingLarge Reasoning Models

  28. verdi: retrieval is not transfer for continual world model optimization

    Aug 10, 2026Junyu Wu, Shiqin Nie, Youyi Kou +9World ModelsCross-Task Knowledge Transfer

  29. CIDER: A Dataset of Contextual Disclosure Boundaries for Privacy Preference Alignment

    Aug 10, 2026Bingcan Guo, Eryue Xu, Jijie Zhou +2PrivacyDisclosures

  30. ChronoState: Hidden Elapsed-Time Conditioning for Temporal-State Action Selection in Frozen-Backbone Language Models

    Aug 10, 2026Sam Siavoshian, Omar Ramadan, Amir K. Saeed +3ChronosFrozen Language Model

  31. Keep It Simple: Multi-Key Episodic Memory Retrieval for Ultra-Long Video Understanding

    Aug 7, 2026Yeeun Choi, Youngbeom Yoo, Joon-Young Lee +2Video UnderstandingEpisodic Memory

  32. DAEP: Difficulty-Aware Evidence Planning for Medical Video Corpus Temporal Answer Grounding

    Aug 7, 2026Tianjian He, Yujie Liu, Zhiping Huang +1Video Temporal GroundingTemporal Grounding

  33. Test-Time Scaling in Reasoning LLMs: Inference Regimes, Evaluation, and Reproducibility

    Aug 4, 2026Mohsen Hariri, Weicong Chen, Nahal Shahini +11Test-Time ScalingInference-Time

  34. Global Optimization and Inference-Time Region Grafting for Agentic Workflows

    Aug 3, 2026Donghyeok Koh, Gyuwan Kim, Jinyeong Bak +4Agentic WorkflowsAgentic Inference

  35. Secrets Everywhere: Auditing Memorization in Mobility Prediction Models

    Aug 3, 2026Anne Josiane Kouam, Hristo Boyadzhiev, Konrad RieckMobilityPrivacy

  36. Where Reasoning Diverges: Localized Multi-Agent Debate for Multi-Hop Question Answering

    Aug 2, 2026Weijun Gao, Xiang Ding, Haoyang Liu +1Multi-Agent DebateDebate

  37. ACE-GraphRAG: Agentic Context Engineering for Hierarchical GraphRAG

    Aug 2, 2026Yongfeng Huang, Yuren Lai, Ruiying Chen +3Graph-Based Retrieval Augmented GenerationGraph-Llm Integrations

  38. MedSAM2-Anatomy: Training-Free Inference-Time Optimization for Musculoskeletal Segmentation

    Jul 31, 2026John Garcia Henao, Nicholas Bünger, Benedikt Herzog +11Anatomical PriorsInference-Time

  39. Bridging Inference-Time Scaling and Episodic Memory with Action-Centric Graphs

    Jul 29, 2026Xu Zheng, Chaohao Lin, Zhuomin Chen +4Graph-Structured MemoriesEpisodic Memory

  40. Steering Instruction Hierarchies at Inference Time

    Jul 28, 2026Siqi Zeng, Sewoong Lee, Han Zhao +1Instruction-Tuned ModelsSteering

  41. Distilling Temporal Search and Reasoning: Evolving LLMs for Future Prediction via Harness-Assisted Efficient Data Synthesis

    Jul 28, 2026Wanxu Cai, Zhengyu Chen, Huaisheng Zhu +3Inference-TimeReasoning Skills

  42. A Multi-level Information Integration Framework for Physically Verifiable Fault Diagnosis of Rotating Machinery

    Jul 24, 2026Yuntong Chen, Jianyu Liu, Yingqi Li +5Fault DiagnosisReport

  43. Inference-Time Scaling of Diffusion Models via Progressive Seed Pruning

    Jul 23, 2026Rogerio Guimaraes, Pietro PeronaDiffusion ModelsInference-Time

  44. OpenForgeRL: Train Harness-native Agents in Any Environment

    Jul 23, 2026Xiao Yu, Baolin Peng, Ruize Xu +7Agent HarnessInference-Time

  45. Test-Time Scaling via Error Localization

    Jul 23, 2026Rajiv Shailesh Chitale, Rahul Madhavan, Taneesh Gupta +2Test-Time ScalingInference-Time

  46. Best-of-Evidence: Best-of-N Selection under Partial Verification

    Jul 23, 2026Cenwei Zhang, Teng Fang, Yuxia Wang +3Best-Of-NVisual Evidence

  47. CUSUM-Shaped Inference-Time Monitoring and Targeted Re-Decoding for Quantized Small Language Model Reasoning

    Jul 22, 2026El Hassane Ettifouri, Ayoub Belfatmi, Mahaman Sanoussi Yahaya Alassan +1Inference-TimeDecoding

  48. On the Diverse Dynamical Behaviors Arising in Deep Linear Transformers

    Jul 20, 2026Sixu Li, Thomas Jacob Maranzatto, Jan Peszek +5Transformer ArchitecturesLinear Attention

  49. DiFA: Inference-Time Forward-Process Alignment for Diffusion Models

    Jul 20, 2026Shigui Li, Delu ZengDiffusion AlignmentDiffusion Models

  50. Residual-Guided Multi-Resolution Refinement of Foundation Models: A Case Study in Drought Forecasting

    Jul 20, 2026Wentao Gao, Jiuyong Li, Lin Liu +4Time Series Foundation ModelsFoundation Model

  51. Chronofy: A Temporal-Logical Decay Architecture for Information Validity in Time-Aware Retrieval-Augmented Generation

    Jul 17, 2026Muntaser Syed, Marius Silaghi, Sheikh Abujar +1ChronosInference-Time