Multi-Stage Training

Momentum

8 papers in the last four weeks, up 100% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 53

All topics
CardsList
  1. Closing the Loop: Practical Training Recipes for Looped Language Models

    Sep 30, 2026Andrei Marchenko, Viacheslav Bezrukov, Oleg Kashurin +5Recurrent ModelLoop

  2. GAE: General Action Expert for Real-Time Humanoid Teleoperation

    Sep 28, 2026Yuefan Wang, Huaicheng Zhou, Xiao He +6Full-Body Humanoid ControlTeleoperation

  3. An Active-Bottleneck Mechanism for Weak-to-Strong Generalization

    Sep 27, 2026Mohammad Zeinalpour, Amir NajafiMulti-Stage TrainingBottlenecks

  4. Learning to Defer with Guidance on Real World Medical Data

    Sep 22, 2026Emma Sun, Joshua Strong, Alison NobleHuman AnnotationsMulti-Stage Training

  5. When EOS Tokens Disagree: Understanding Length Inflation in On-Policy Distillation

    Sep 17, 2026Yuxiao Yang, Tianrun Yu, Shangzhe Li +6Multi-Stage Training

  6. Learning with Synthetic Data via SGD in High-Dimensional Linear Regression

    Sep 10, 2026Jichu li, Difan ZouSynthetic DataMulti-Stage Training

  7. Compression Beyond the Uncompressed: A Two-Stage Training Recipe for Soft Context Compression in RAG

    Sep 4, 2026Shuyu Guo, Shuo Zhang, Zhaochun RenSearch-Augmented ReasoningData Compression Methods

  8. Scaling Bimanual Household Manipulation from 1,500 hours of Demonstrations to On-Policy Corrections

    Sep 3, 2026Jiafeng Xu, Qi Li, Yan Shen +7Bimanual ManipulationRobot Systems

  9. SimpleDesign: A Joint Model for Protein Sequence and Structure Codesign

    Sep 3, 2026Jiarui Lu, Yuyang Wang, Yizhe Zhang +4Protein DesignGenerative Models

  10. Cluster-Aware Over-the-Air Federated Learning with Energy-Harvesting Devices: From Global Training to Model Personalization

    Aug 2, 2026Furkan Bagci, Busra Tegin, Mohammad Kazemi +1Federated LearningPower Allocation

  11. DiffusionGemma Technical Report

    Jul 31, 2026DiffusionGemma Team, Adrien Ali Taïga, James Assiene +41Diffusion Language ModelsAutoregressive Generation

  12. Pipelined Gradient Coding

    Jul 22, 2026Xian Su, Jun LiPartitioningGradient

  13. Single-Teacher View Augmentation: Enhancing Knowledge Distillation with Student-Guided Perturbations

    Jul 13, 2026Xuyi Yu, Yaohua Liu, Ziming Song +3Knowledge DistillationMulti-Stage Training

  14. The Anatomy of Implicit Bias: Information Allocation in Neural Network Training

    Jul 8, 2026Zhang Gongyue, Wang Zhiyong, Liu Donghan +3Neural Network OptimizationOptimizer Design

  15. Stabilizing Extrapolation in Looped Transformers via Learned Stochastic Stopping

    Jun 29, 2026Hsun-Yu Kuo, El Mahdi Chayti, Patrik Reizinger +2StochasticMulti-Stage Training

  16. GCT-MARL: Graph-Based Contrastive Transfer for Sample-Efficient Cooperative Multi-Agent Reinforcement Learning

    Jun 23, 2026Animesh Animesh, Satheesh K Perepu, Kaushik DeyMulti-Agent Reinforcement LearningIterative Co-Training

  17. Breaking Shortcut Learning for Cross-Trial EEG-Guided Target Speech Extraction via Two-Stage Training

    Jun 23, 2026Wonchul Shin, Inyong Choi, Kyogu LeeTarget Speaker ExtractionElectroencephalography

  18. Marginal Advantage Accumulation for Memory-Driven Agent Self-Evolution

    Jun 18, 2026Mingyu Yang, Keye Zheng, Congchao Cheng +4Probe-Logit DistillationTrajectory-Aware Hidden-State Analyses

  19. LLMZero: Discovering Adaptive Training Strategies for RL Post-Training via LLM Agents

    Jun 16, 2026Haoyang Fang, Wei Zhu, Boran Han +11Reinforcement Learning Post-TrainingLarge Language Model Training

  20. LoopCoder-v2: Only Loop Once for Efficient Test-Time Computation Scaling

    Jun 16, 2026Jian Yang, Shawn Guo, Wei Zhang +16Code OptimizationLoop

  21. Adaptive Band Selection for Hyperspectral Classification with Spatially Disjoint Evaluation

    Jun 4, 2026Ikram El-Hajri, Ouassim Karrakchou, Alejandro MousistHyperspectral ImageSpectral

  22. Task-Focused Memorization for Multimodal Agents

    May 29, 2026Tao Zou, Yichen He, Tian Qiu +2Multimodal MemoryMultimodal Agents

  23. Transformers Provably Learn to Internalize Chain-of-Thought

    May 27, 2026Yixiao Huang, Hanlin Zhu, Zixuan Wang +4Transformer ArchitecturesChain-of-Thought Reasoning

  24. SCRIPT: Scalable Diffusion Policy with Multi-stage Training for Language-driven Physics-based Humanoid Control

    May 21, 2026Jingyan Zhang, Han Liang, Ruichi Zhang +6Full-Body Humanoid ControlDiffusion Policies

  25. Multi-Stage Training for Abusive Comment Detection in Indic Languages

    May 21, 2026Pranshu Rastogi, Madhav Mathur, Ramaneswaran S +1Hate Speech DetectionContent Moderation

  26. Thermodynamic Irreversibility of Training Algorithms

    May 21, 2026Liu Ziyin, Yuanjie Ren, Adam Levine +1IrreversibilityStatistical Physics

  27. Freeze Deep, Train Shallow: Interpretable Layer Allocation for Continued Pre-Training

    May 12, 2026Yu-Hang Wu, Qin-Yuan Liu, Qiu-Yang Zhao +3PretrainingLayer-Wise

  28. Optimizing Server Placement for Vertical Federated Learning in Dynamic Edge/Fog Networks

    May 10, 2026Su Wang, Mung Chiang, H. Vincent PoorFederated LearningFog

  29. Architecture-agnostic Lipschitz-constant Bayesian header and its application to resolve semantically proximal classification errors with vision transformers

    May 7, 2026Frederik Schäfer, Luis Mandl, Lars Kälber +1Noisy LabelsSelf-Supervised Vision Transformers

  30. Accelerating Long-Tail Generation in Synchronous RLHF Training via Adaptive Tensor Parallelism

    May 3, 2026Long Zhao, Qinghe Wang, Jiaan Zhu +5Reinforcement Learning From Human FeedbackMulti-Stage Training

  31. Focus and Dilution: The Multi-stage Learning Process of Attention

    May 2, 2026Zheng-An Chen, Pengxiao Lin, Zhi-Qin John Xu +1Transformer AttentionTransformer Architectures

  32. Optimized Deferral for Imbalanced Settings

    Apr 30, 2026Corinna Cortes, Anqi Mao, Mehryar Mohri +1Imbalanced ClassificationMulti-Stage Training

  33. Tstars-Tryon 1.0: Robust and Realistic Virtual Try-On for Diverse Fashion Items

    Apr 21, 2026Mengting Chen, Zhengrui Chen, Yongchao Du +16Virtual Try-OnGarments

  34. Small Model as Master Orchestrator: Learning Unified Agent-Tool Orchestration with Parallel Subtask Decomposition

    Apr 18, 2026Wenzhen Yuan, Wutao Xiong, Fanchen Yu +7Multi-Agent OrchestrationOrchestration

  35. Can Generative Artificial Intelligence Survive Data Contamination? Theoretical Guarantees under Contaminated Recursive Training

    Feb 17, 2026Kevin Wang, Hongqian Niu, Didong LiMulti-Stage Training

  36. Stabilizing Physics-Informed Consistency Models via Structure-Preserving Training

    Feb 10, 2026Che-Chia Chang, Chen-Yang Dai, Te-Sheng Lin +2Physics-Informed LearningPartial Differential Equations

  37. MixFlow Training: Alleviating Exposure Bias with Slowed Interpolation Mixture

    Dec 22, 2025Hui Li, Fu-Yun Wang, Haoyuan Xia +4Diffusion ModelsInterpolation

  38. Physics-Guided Residual Reinforcement Learning for Humanoid Narrow-Path Traversal

    Aug 28, 2025Tianchen Huang, Sisheng Chen, Wei Zhou +8Multi-Stage Training

  39. DPO Unchained: Your Training Algorithm is Secretly Disentangled in Human Choice Theory (and its Loss' Convexity is Dispensable)

    Jul 10, 2025Wenxuan Zhou, Shujian Zhang, Brice Magdalou +4Backtranslation Augmented Direct Preference OptimizationNonconvex

  40. AneumoBench: A Source-Linked Benchmark for Synthetic-Geometry Transfer in Aneurysm CFD

    May 19, 2025Xigui Li, Yuanye Zhou, Feiyang Xiao +16Computational Fluid DynamicSurrogate Models