Large Language Model Training

Latest papers 174

All topics
CardsList
  1. Dynamic Minimax Regret Optimization for Robust LLM Post-Training

    Oct 5, 2026Chengbo Zang, Haoyu Dong, Mehmet Kerem Turkcan +3Large Language Model Training

  2. FastCI: Efficient GPU-Intensive CI for LLM Training Frameworks

    Oct 1, 2026Tianshuo Qiao, Naiqian Zheng, Xiaopeng Liu +4Large Language Model TrainingCpu-Gpu Hybrid Designs

  3. Leto: Fast In-Place Recovery for LLM Training on Surviving Hardware

    Sep 30, 2026Geon-Woo Kim, Joon Ha Kim, Daehyeok KimLarge Language Model TrainingSurvival Analysis

  4. dattri-LLM: A Unified and Efficient Library for Training Data Attribution at LLM Scale

    Sep 30, 2026Shixuan Liu, Tongli Zhou, Junwei Deng +2Large Language Model TrainingLarge Language Models(Llms

  5. Trajectory Soup: Pushing the Compute-Scaling Frontier of LLM Mid-training via Diverse Trajectories

    Sep 29, 2026Zhehao Huang, Changxin Tian, Qingyuan Yang +5Large Language Model TrainingPost-Training

  6. Normalize-Then-Precondition: A Hierarchical Approach to Marginal Scale and Interaction Geometry for LLM Training

    Sep 29, 2026Zixuan Gong, Zeyu Gan, Jiaye Teng +1Spectral PreconditioningLarge Language Model Pretraining

  7. AutoLoCo: Communication Efficient Distributed LLM Training via Adaptive Synchronization

    Sep 29, 2026Pengyu He, Yan Zhang, Ruien Li +1Large Language Model TrainingBatch

  8. Training LLMs to Verbalize Evaluation Awareness

    Sep 28, 2026Usman Anwar, Sahar Abdelnabi, David KruegerVerbalizationLarge Language Model Evaluation

  9. The Life of a Token: from Words to Bits on the Wire

    Sep 17, 2026Davide Avesani, Pengwenlong Gu, Sotiris Skaperas +1Large Language Model TrainingDeep Learning Architectures

  10. Preventing Model Collapse: A Fisher-Rao Perspective on the Dynamics of Training with Synthetic Data

    Sep 16, 2026Matteo Marchi, João Pedro Silvestre, Bahman Gharesifard +1Large Language Model TrainingCollapse

  11. MiST: Mid-Training LLMs for Cybersecurity

    Sep 16, 2026Oded Ovadia, Elad Ben Zaken, Elad Guttman +1CybersecurityLarge Language Model Training

  12. Performance, Efficiency and Collapse -- Advantages and Challenges in Offline Post-training of Code LLMs

    Sep 14, 2026Abhinav Anand, Sanjana Reddy Pachika, Shweta Verma +1Reinforcement Learning Post-TrainingLarge Language Model Training

  13. BRACE: Anchored Bellman-Residual Correction for Stale Critics in Asynchronous RL

    Sep 9, 2026Guanqun Zhao, Zijun Xie, Binbin Zheng +3Gradient StalenessLarge Language Model Training

  14. Parallelism Strategy Chaining for Fast Training Convergence

    Sep 7, 2026Minchul Kang, Changyong Shin, Younghun Go +4Large Language Model TrainingLanguage Model Perplexity

  15. BASP: Communication-Efficient Batch-Aware Sequence Parallelism for LLM Training

    Sep 2, 2026Bigyan Ghimire, Jon C. CalhounLarge Language Model TrainingSequence Modeling

  16. Efficiently Estimating Optimal Hyperparameter Scaling Laws through Power-Law Entropy Search

    Sep 1, 2026Zhiliang Chen, Sebastian Ament, David Eriksson +4HyperparameterLarge Language Model Training

  17. From Rollouts to Recipes: Self-Contained Post-Training for LLMs

    Sep 1, 2026Yifei Li, Lingling Zhang, Muye Huang +3Post-TrainingReinforcement Learning Post-Training

  18. Information Abundance Paradox: Long-Context Training Undermines Parametric Knowledge

    Aug 12, 2026Arda Uzunoglu, Benjamin Van Durme, Daniel KhashabiEfficient Long-Context InferenceLarge Language Model Training

  19. LazyTrain: Limited-resource Allocation toward Zero-waste Yield Optimization in Large Language Model Training

    Aug 12, 2026Xiaojun Wu, Cehao Yang, Honghao Liu +5Large Language Model TrainingGraphics Processing Unit Memory

  20. Can Bayesian Optimization Efficiently Find a Strong Single Expert in Neural Thickets?

    Aug 11, 2026Nigel Bastian Cendra, Abdelhamid Ezzerg, Fernando Julio Cendra +2Large Language Model TrainingGradient-Based Optimization

  21. MoE Proxy Models for Low-Cost Failure Reproduction and Diagnosis in LLM RL Post-Training

    Aug 11, 2026Yikai Wang, Chuansai Zhou, Yuhang Zhou +10Large Language Model TrainingReinforcement Learning Post-Training

  22. Evaluation-Conditioned Training: Teaching Models to Generalize to Stronger Oversight Regimes

    Aug 10, 2026Alec Harris, Kasey Corra, Archie Chaudhury +1Large Language Model EvaluationLarge Language Model Alignment

  23. Fusion Training for Mathematical Generalization in Large Language Models

    Aug 10, 2026Congfeng Cao, Pengyu Zhang, Jelke BloemLarge Language Model TrainingThoughts

  24. Training Small LLMs as Spatial Multi-Agent Policies

    Aug 2, 2026Yi Mao, Andrew PerraultMulti-Agent Reinforcement LearningLarge Language Model Training

  25. Knowing When to Quit: Diagnosing and Training LLMs to Abort Futile Reasoning

    Jul 31, 2026Xinyan Guan, Jiali Zeng, Chunlei Xin +5RefusalsLarge Language Model Training

  26. Towards joint scaling laws with optimal batch size schedules

    Jul 30, 2026Jiaxiang Li, Zhiqi Bu, Shiyun XuBatchLarge Language Model Training

  27. SDO: Structure-Aware Data Organization for Efficient LLM Post-Training

    Jul 29, 2026Jinliang Gao, Ning Yang, Hai Wang +2Large Language Model TrainingPost-Training

  28. A Defense of the Quadratic Model

    Jul 23, 2026Alexandru Meterez, Pranav Ajit Nair, Depen Morwani +3Anisotropic Loss LandscapesLarge Language Model Training

  29. Training Large Language Models for Self-Explanation Faithfulness

    Jul 23, 2026Yeoktatt Cheah, María Pérez-Ortiz, Noah Y. Siegel +1LLM Reasoning StrategiesLarge Language Model Reinforcement Learning

  30. Agora: Collective and Permissionless Internet-Scale Pretraining of Large Language Models

    Jul 14, 2026Gil Avraham, Violetta Shevchenko, Hadi Mohaghegh Dolatabadi +9Large Language Model TrainingPretraining

  31. Proxy Exploration and Reusable Guidance: A Modular LLM Post-Training Paradigm via Proxy-Guided Update Signals

    Jul 13, 2026Daocheng Fu, Rong Wu, Yu Yang +7Reinforcement Learning Post-TrainingPost-Training

  32. WSqD: A Horizon-Free Learning Rate Schedule for Large Model Training

    Jul 12, 2026Jianhao Ma, Yuxin ChenBatchWarm Starts

  33. Self-Guided Test-Time Training for Long-Context LLMs

    Jul 10, 2026Xinyu Zhu, Zhe Xu, Xiaohan Wei +10Efficient Long-Context InferenceTest-Time Training

  34. Train Smarter, Not Longer: Memorization-Guided Data Reuse for Efficient LLM Training

    Jul 6, 2026Jingwei Zuo, Cong Zeng, Ilyas Chahed +6Large Language Model TrainingRecurrent Model

  35. PHOENIX: Resilient LLM Training with Hot-Swapping via Zero-Overhead Checkpoint

    Jul 2, 2026Haotian Xie, Junlin Chen, Mingkai Zheng +2Large Language Model TrainingIntermediate Checkpoints

  36. FaithMed: Training LLMs For Faithful Evidence-Based Medical Reasoning

    Jul 1, 2026Zhiyun Zhang, Liwen Sun, Xiang Qian +1Clinical Reasoning TrainingLLM Reasoning Strategies

  37. AutoTrainess: Teaching Language Models to Improve Language Models Autonomously

    Jun 30, 2026Zhaojian Yu, Penghao Yin, Shuzheng Gao +3Large Language Model TrainingLanguage Modeling

  38. One-Step Gradient Delay is Not a Barrier for Large-Scale Asynchronous Pipeline Parallel LLM Pretraining

    Jun 29, 2026Philip Zmushko, Egor Petrov, Nursultan Abdullaev +2Asynchronous ExecutionLarge Language Model Training

  39. From Search to Synthesis: Training LLMs as Zero-Shot Workflow Generators

    Jun 29, 2026Gan Luo, Zihan Qin, Bin Dong +1Large Language Model WorkflowsData Generation Pipelines

  40. Smooth Scaling Laws Hide Stepwise Token Learning

    Jun 29, 2026Pingjie Wang, Zechen Hu, Peiru Yang +2Scaling LawsLarge Language Model Training

  41. On the Nonlinearity of Learning Rate Scaling for LLM Training

    Jun 28, 2026Zaiwen Yang, Huaqing Zhang, Jing Xu +1BatchLarge Language Model Training

  42. Mechanism-Driven Monitors for Preemptive Detection of LLM Training Instability

    Jun 26, 2026Ruixuan Huang, Yipei Wang, Wenyi Fang +7Large Language Model TrainingLarge Language Models Fail