Diffusion Language Model Inference

Latest papers 108

All topics
CardsList
  1. Denoising Blocks, Not Tokens: Efficient Compressed Continuous Diffusion with Branching Token Realization

    Oct 7, 2026Xinsong Feng, Peng Du, Zhizhuo Yang +3Diffusion Language ModelsDiffusion Language Model Inference

  2. Denoising Surface: Modeling and Predicting Inference Cost for Diffusion LLM Serving

    Sep 30, 2026Haoyu Zheng, Fangcheng Fu, Binhang Yuan +6Cost-Aware InferenceDiffusion Model Serving

  3. Blackboard Intelligence Can Surpass Autoregressive on Globally Constrained Problems

    Sep 30, 2026Woosang Jeon, Jaeyeon Kim, Sham Kakade +6Inference-Time SearchCombinatorial Optimization

  4. Acceleration of Diffusion Language Model through Discrete Average Generator

    Sep 29, 2026Yidong Ouyang, Zhengyan Wan, Themis Haris +8Few-Step Diffusion SamplingDiffusion Language Model Inference

  5. On Trajectory-Aware Training for Masked Diffusion Language Models

    Sep 29, 2026Manuel Madeira, Amitis Shidani, Alice Bizeul +6Masked Diffusion ModelsDiffusion Language Model Inference

  6. Reciprocal Guidance: Orchestrating Draft and Verify Budgets for Advancing the Diffusion-AR Self-Speculation Frontier

    Sep 28, 2026Linye Wei, Shutian Zheng, Haoyu Zeng +1LLM Inference SchedulingSpeculative Decoding

  7. Faster Block-Diffusion Serving with Distribution-Free Risk Guarantees

    Sep 27, 2026Jungseob Lee, Dongyub Jude Lee, Chanjun Park +2Diffusion Language Model InferenceLLM Inference Acceleration

  8. One Latent, Many Tokens: Jointly Learning Compressed Embeddings for Efficient Language Diffusion

    Sep 27, 2026Yulin Yuan, Ying Zhang, Xiangming MengDiffusion Language Model InferenceDiffusion Language Models

  9. Tsubame: Tree Replay for Diffusion-Based Speculative Decoding

    Sep 27, 2026Yepeng Weng, Qiao Hu, Takehisa YairiSpeculative Decoding for Diffusion Language ModelsSpeculative Decoding

  10. OLED-MoE: Accelerating MoE-Based dLLM Inference via Inter-Iteration Locality-Aware Expert Offloading

    Sep 27, 2026Jingyuan Xiao, Jiayue Wang, Yitao Hu +7Expert OffloadingMixture of Experts

  11. Unmask the State: When Does State Adaptation Matter for Masked Diffusion Language Models

    Sep 27, 2026Injin Kong, Sunghwan Choi, Yohan JoMasked Diffusion ModelsDiffusion Language Model Inference

  12. Diffusion Drafts, AR Verifies: Accelerating Document OCR with Self-Speculative Decoding

    Sep 22, 2026Dohyun Kim, Sungjun Han, Hyungguk Kim +4Autoregressive DiffusionSpeculative Decoding

  13. Parallelism, critical windows, and separations among diffusion language models

    Sep 17, 2026Sitan Chen, Liye WangMasked Diffusion ModelsDiffusion Sampling

  14. How to Guide Your Language Flow

    Sep 16, 2026Rohit Dilip, Tianrong Chen, Yuyang Wang +3Flow MatchingDiffusion Model Guidance

  15. Early-Bird Decoding: Accelerating Diffusion LLMs with Learnable Block Sizes and Parallel Sampling

    Sep 15, 2026Lixuan Wei, Wei Zhou, Jianwen Wu +3Diffusion Language Model InferenceParallel Decoding

  16. Temporal Self-Distillation: Faster Inference in Discrete Diffusion Language Models

    Sep 14, 2026Shijian Xu, Andrea Miele, Metod Jazbec +3Diffusion Model DistillationDiffusion Language Model Inference

  17. Fixed State, Long Reach: What a Constant-Size Cache Buys Block Diffusion at Scale

    Sep 14, 2026Vaibhav Singh, Pierre-André Noël, Torsten Scholak +2Blockwise Diffusion Language ModelsDiffusion Language Model Inference

  18. Self-Orchestrating Language Models: Leveraging Semantic Dependence for Efficient Inference

    Sep 13, 2026Tian JinLong-Context Language Model InferenceEfficient Language Model Reasoning

  19. Routing by Reasoning Need: Trajectory-Aware Decoding Control for Diffusion Vision-Language Models

    Sep 12, 2026Yixiang Liu, Zhongxing Xu, Zhonghua Wang +1Diffusion Language Model InferenceVLM Reasoning

  20. Diffusion Language Models for Mobile Edge Agentic AI: Foundations, Applications, and Challenges

    Sep 7, 2026Chenqi Li, Minghui Min, Dusit Niyato +1On-Device Language Model InferenceDiffusion Language Model Inference

  21. Unlocking Lossless Speedups in LLMs via Discrete Diffusion

    Sep 3, 2026Subham Sekhar Sahoo, Lingjie Chen, Khiem Pham +14Diffusion Language Model InferenceLLM Inference Acceleration

  22. Ripple-Pivot Search: Active Parallel Decoding for Diffusion Large Language Models

    Aug 12, 2026Yushi Ye, Xu Chen, Haoyun Jiang +7Language Model DecodingDiffusion Language Model Inference