Pipeline Parallelism

Momentum

4 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 26

All topics
CardsList
  1. HAPMoE: Heterogeneity-Aware Automatic Parallelism Planning for Mixture-of-Experts Models Training

    Sep 30, 2026Mengyuan Fan, Peizhuang Cong, Zixiao Huang +7Expert ParallelismHeterogeneous Computing

  2. Spexis: Speculative Lookahead Scheduling for LLM Inference

    Sep 28, 2026Hyungyu Jung, Jaehyeok Yu, Hoonseo Choi +3LLM Inference EfficiencyLLM Inference Scheduling

  3. Para-Pipe: Exploiting Hierarchical Operator Parallelism of ML Computational Graphs on SoCs

    Sep 3, 2026Yujie Zhang, Huiying Lan, Ehsan Aghapour +5Efficient Neural Network InferenceEnergy-Efficient ML

  4. CTA-Pipelining: A Latency-Oriented Spatial Scaling Method for Multi-GPU Systems

    Jul 8, 2026Tingkai Liu, Muralidhar Andoorveedu, Sanjoy Das +2GPU Kernel OptimizationHigh-Performance Computing

  5. One-Step Gradient Delay is Not a Barrier for Large-Scale Asynchronous Pipeline Parallel LLM Pretraining

    Jun 29, 2026Philip Zmushko, Egor Petrov, Nursultan Abdullaev +2Muon OptimizerPipeline Parallelism

  6. Accelerating Disaggregated RL for Visual Generative LLMs with Diffusion-Based Parallelism and Trainer-Assisted Generation

    Jun 23, 2026Sijie Wang, Zhengyu Qing, Zhiqiang Tan +6Reinforcement LearningDistributed RL

  7. Breaking the Bubble: Asynchronous Pipeline Parallel Training with Bounded Weight Inconsistency

    Jun 5, 2026Itay Elam, Eliron Rahimi, Avi Mendelson +1Neural Network Training DynamicsPipeline Parallelism

  8. Learned Subspace Compression for Communication-Efficient Pipeline Parallelism

    Jun 3, 2026Paul Janson, Edouard Oyallon, Eugene BelilovskyLLM CompressionCommunication-Efficient Distributed Training

  9. AMDP: Asynchronous Multi-Directional Pipeline Parallelism for Large-Scale Models Training

    May 28, 2026Ling Chen, Houming Wu, Wenjie YuPipeline ParallelismLLM Training

  10. A Tabular Schedule Abstraction for Communication-Aware Evaluation of Pipeline-Parallel LLM Training

    May 19, 2026Daniel Barley, Jonathan Leis, Benjamin Klenk +1Communication-Efficient Distributed TrainingPipeline Parallelism

  11. DisagMoE: Computation-Communication overlapped MoE Training via Disaggregated AF-Pipe Parallelism

    May 10, 2026Zhichen Zeng, Chi-Chih Chang, Jiayi Wang +10Expert ParallelismCommunication-Efficient Distributed Training

  12. Efficient Training on Multiple Consumer GPUs with RoundPipe

    Apr 29, 2026Yibin Luo, Shiwei Gao, Huichuan Zheng +2GPU AccelerationLLM Fine-Tuning

  13. Efficient, VRAM-Constrained xLM Inference on Clients

    Apr 29, 2026Aditya Ukarande, Deep Shekhar, Marc Blackstein +1GPU AccelerationEfficient VLM Inference

  14. JigsawRL: Assembling RL Pipelines for Efficient LLM Post-Training

    Apr 26, 2026Zhengding Hu, Hehua Ouyang, Chang Chen +6RL Post-TrainingPipeline Parallelism

  15. PipeLive: Efficient Live In-place Pipeline Parallelism Reconfiguration for Dynamic LLM Serving

    Apr 14, 2026Xu Bai, Muhammed Tawfiqul Islam, Chen Wang +1LLM Inference EfficiencyLLM Serving

  16. Executing as You Generate: Hiding Execution Latency in LLM Code Interpreters

    Apr 1, 2026Zhensu Sun, Zhihao Lin, Zhi Chen +4LLM Inference AccelerationPipeline Parallelism

  17. Concertina: Data-Centric Adaptive Pipeline Parallelism for Efficient Heterogeneous Long-Context LLM Training

    Sep 25, 2025Shiju Wang, Yujie Wang, Fangcheng Fu +6Long-Context Language ModelingEfficient Language Model Training

  18. Prima.cpp: Fast 30-70B LLM Inference on Heterogeneous and Low-Resource Home Clusters

    Apr 7, 2025Zonghang Li, Tao Li, Wenjiao Feng +8On-Device Language Model InferenceLLM Inference