Intermediate Checkpoints

Momentum

6 papers in the last four weeks, up 20% on the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 49

All topics
CardsList
  1. Does Scaling Reinforcement Learning Really Require More Training?

    Oct 1, 2026Bangji Yang, Jiajun Fan, Hongba Ma +2Offline Reinforcement LearningSequential Scaling

  2. Sharpen Before You Adapt: Data-Free Entry-State Sharpening for Test-Time Reinforcement Learning

    Oct 1, 2026Zhanming Zhang, Vinoth SelvendranIntermediate CheckpointsSharpness-Aware Minimization

  3. When Do Biological Reasoning Models Use Their Biological Inputs?

    Oct 1, 2026Ada Fang, Nikitha Thoduguli, Lukas Fesser +3Evidence ConflictFoundation Model

  4. Argus: A Real-EKS Study of When Predicting Spot Interruptions Beats Simple Checkpointing

    Sep 30, 2026Angshuman Chakravertty, MD RayyanCloudIntermediate Checkpoints

  5. Where Scientific Search Agents Fail: Decision-Checkpoint Auditing of Exposure and Inspection Attempts

    Sep 29, 2026Hongmin Li, Wanli ZhaoScientific AgentsSearch Algorithms

  6. S3S^3: Spectral Null-Space Swap Makes Reasoning Models Efficient

    Sep 29, 2026Hongbo Ma, Sansheng Cao, Jiajun Fan +2Intermediate Checkpoints

  7. From Checkpoint Variation to Selection Gains in Supervised Fine-Tuning

    Sep 29, 2026Yupeng Chang, Wenxuan Zhang, Yuan WuSupervised FinetuningAlignment-Aware Selection

  8. Do System One Decisions Add Up? A Study of Probabilistic Coherence

    Sep 27, 2026Saman Sarker JoyConfidence CalibrationDecisions

  9. Certified Against Which Oracle? Execution Labels Set the Reported Risk of Conformal Abstention for Text-to-SQL

    Sep 22, 2026Jiamiao Liu, Dewen Qiao, Yu Zhang +1OraclesText-To-Sql

  10. Stochastically Perturbed Weights: Ensembles from Deterministic Machine-Learning Weather Models

    Sep 8, 2026Simon Adamov, Oliver Fuhrer, Reto Knutti +1Artificial Intelligence Weather ModelsModel Weights

  11. Reference-free logged energy-oracle recovery for neural approximations of symmetric coercive variational problems: conforming Riesz reconstruction and archive-level selection

    Aug 17, 2026Karim Bounja, Lahcen Laayouni, Boujemaa Achchab +1Reconstruction ErrorNeural Approximations

  12. Measuring Task-Agnostic Training Data Influence Across Language Model Pretraining

    Aug 13, 2026Yuto Nishida, Hirokazu Kiyomaru, Yusuke Oda +6Large Language Model PretrainingTraining Data

  13. Is SwiGLU's Open Positive Tail Necessary? Evidence from Closed-Tail Gating with MemGLU

    Aug 7, 2026Yuting Ge, Pengju Yang, Mingkai NieSuppressionClosure

  14. Lossless Tensor Compression as Program Synthesis

    Aug 3, 2026Jieke Shi, Junda He, Wenjia Jiang +11Data Compression MethodsIntermediate Checkpoints

  15. Learned, Relied Upon, or Necessary? Separating Checkpoint Dependence from Task-Level Value in Sheaf GNNs

    Jul 28, 2026Yi LiuSheaf Neural NetworksGraph Neural Networks

  16. Which Values Do LLMs Confuse? A Schwartz-Based Recognition Study

    Jul 22, 2026Andrei Chetvergov, Stepan Ukolov, Timofei Sivoraksha +5Large Language Model EvaluationLarge Language Models Fail

  17. Measuring Reward-Seeking via Contrastive Belief Updates

    Jul 21, 2026Axel Højmark, Jérémy Scheurer, Evgenia Nitishinskaya +5Progress Reward ModelingReward Signal

  18. StructAgent: Harness Long-horizon Digital Agents with Unified Causal Structure

    Jul 13, 2026Wenyi Wu, Sibo Zhu, Kun Zhou +3Long-Horizon AgentsAgent Loop

  19. DynamicMCPBench: A Trace-Grounded, Effect-Scored Benchmark for LLM Agents over Live MCP Servers

    Jul 10, 2026Jerzy Kamiński, Ilya Galyukshev, Artem Kuznetsov +4Agentic BenchmarksLarge Language Model Agents

  20. Final Checkpoints Are Not Enough: Analyzing Latent Reasoning Faithfulness Along Training Trajectories

    Jul 7, 2026Hengyu Jin, Shu Yang, Di WangEfficient Latent ReasoningExplanation Faithfulness

  21. Teaching Code LLMs to Reason with Intermediate Formal Specifications

    Jul 5, 2026Minh Le-Anh, Cuong Chi Le, Tien N. NguyenFormal VerificationIntermediate Checkpoints

  22. PHOENIX: Resilient LLM Training with Hot-Swapping via Zero-Overhead Checkpoint

    Jul 2, 2026Haotian Xie, Junlin Chen, Mingkai Zheng +2Large Language Model TrainingIntermediate Checkpoints

  23. The Moving Target: A Longitudinal Audit of Trustworthiness Drift Across Twelve Checkpoints of Open-Source Chat LLMs

    Jul 1, 2026Zhichao Fan, Yanhang Li, Zexin Zhuang +2Large Language Model ReliabilityAI Trustworthiness

  24. Concordia: JIT-Compiled Persistent-Kernel Checkpointing for Fault-Tolerant LLM Inference

    Jun 22, 2026Yuhang Gan, Yiwei Yang, Yuyi Li +6Intermediate CheckpointsLLM Inference Optimization

  25. TRADE: Transducer-Augmented Decoder for Speech LLM

    Jun 7, 2026Yun Tang, Shanil Puri, Shinji Watanabe +1Intermediate Checkpoints

  26. Access Sets Matter: Budgeting Expert Reads for Scalable Weight-Space Model Merging

    May 28, 2026Yuanyi Wang, Yanggan Gu, Su Lu +5MergeInference Workloads

  27. Extrapolative Weight Averaging Reveals Correctness-Efficiency Frontiers in Code RL

    May 27, 2026Kunhao Zheng, Pierre Chambon, Juliette Decugis +4Intermediate CheckpointsOffline Reinforcement Learning

  28. DART: Semantic Recoverability for Structured Tool Agents

    May 22, 2026Ke Yang, Panpan Li, Zonghan Wu +3RollbackIntermediate Checkpoints

  29. Orbax: Distributed Checkpointing with JAX

    May 21, 2026Colin Gaffney, Shutong Li, Daniel Ng +13Intermediate CheckpointsMle-Bench Lite

  30. DeltaBox: Scaling Stateful AI Agents with Millisecond-Level Sandbox Checkpoint/Rollback

    May 21, 2026Yunpeng Dong, Jingkai He, Shiqi Liu +7SandboxRollback

  31. TClone: Low-Latency Forking of Live GUI Environments for Computer-Use Agents

    May 17, 2026Yutong Huang, Vikranth Srivatsa, Alex Asch +2WorkspacesComputer-Use Agents

  32. Crab: A Semantics-Aware Checkpoint/Restore Runtime for Agent Sandboxes

    Apr 30, 2026Tianyuan Wu, Chaokun Chang, Lunxi Cao +2SandboxIntermediate Checkpoints

  33. Step-level Optimization for Efficient Computer-use Agents

    Apr 29, 2026Jinbiao Wei, Kangqi Ni, Yilun Zhao +2Computer-Use AgentsIntermediate Checkpoints

  34. Do Agents Dream of Root Shells? Partial-Credit Evaluation of LLM Agents in Capture the Flag Challenges

    Apr 21, 2026Ali Al-Kaswan, Maksim Plotnikov, Maxim Hájek +3Large Language Model AgentsIntermediate Checkpoints

  35. SegTTA: Training-Free Test-Time Augmentation for Zero-Shot Medical Imaging Segmentation

    Apr 19, 2026Yihong Yao, Chunlei Li, Canxuan Gang +4Semi-Supervised Medical Image SegmentationData Augmentation

  36. When Flat Minima Fail: Characterizing INT4 Quantization Collapse After FP32 Convergence

    Apr 16, 2026Marcus ArmstrongPost-Training QuantizationQuantizer

  37. CC-ΔΘΔΘ: Circuit-Restricted Weight Arithmetic for Selective Refusal

    Feb 4, 2026Aditya Kasliwal, Pratinav Seth, Vinay Kumar SankarapuRefusalsInference-Time Steering