Diffusion Language Model Inference

Latest papers 108

All topics
CardsList
  1. AsyncLane: Decoupling Refinement from Advancement in Diffusion Language Model Decoding

    Jun 7, 2026Yingxuan Ren, Yuxuan Lou, Yong Liu +4LLM Inference SchedulingBlockwise Diffusion Language Models

  2. Self-Augmenting Retrieval for Diffusion Language Models

    Jun 4, 2026Paul Jünger, Justin Lovelace, Linxi Zhao +2Multi-Hop QARetrieval-Augmented Generation

  3. D^2SD: Accelerating Speculative Decoding with Dual Diffusion Draft Models

    Jun 3, 2026Liyuan Zhang, Jiarui Zhang, Jinwei Yao +6Speculative Decoding for Diffusion Language ModelsSpeculative Decoding

  4. SimSD: Simple Speculative Decoding in Diffusion Language Models

    Jun 1, 2026Junxia Cui, Haotian Ye, Runchu Tian +9Masked Diffusion ModelsSpeculative Decoding for Diffusion Language Models

  5. FLARE: Diffusion for Hybrid Language Model

    Jun 1, 2026Yuchen Zhu, Jing Shi, Chongjian Ge +9Diffusion Model ServingDiffusion Language Model Inference

  6. WaveFilter: Enhancing the Long-Context Capability of Diffusion LLMs via Wavelet-Guided KV Cache Filtering

    May 30, 2026Jinnan Yang, Yan Wang, Zhen Bi +5Long-Context Language Model InferenceDiffusion Language Model Inference

  7. What Gets Unmasked First? Trajectory Analysis of Diffusion Models for Graph-to-Text Generation

    May 29, 2026Qing Wang, Jacob Devasier, Chengkai LiMasked Diffusion ModelsLLM Fine-Tuning

  8. dMoE: dLLMs with Learnable Block Experts

    May 29, 2026Sicheng Feng, Zigeng Chen, Gongfan Fang +2Mixture-of-Experts Language ModelsMemory-Efficient Inference

  9. DLM-SWAI: Steering Diffusion Language Models Before They Unmask

    May 28, 2026Hyeseon An, Yo-Sub HanControllable Text GenerationDiffusion Language Model Inference

  10. Cluster-Level Attention-Guided Parallel Decoding for Masked Diffusion Language Models

    May 28, 2026Heqiang Qi, Wei Huang, Mingyuan Bai +1Masked Diffusion ModelsDiffusion Language Model Inference

  11. Dynamic-dLLM: Dynamic Cache-Budget and Adaptive Parallel Decoding for Training-Free Acceleration of Diffusion LLM

    May 27, 2026Tianyi Wu, Xiaoxi Sun, Yanhua Jiao +5Diffusion Language Model InferenceDiffusion Language Model Decoding

  12. Enabling KV Caching of Shared Prefix for Diffusion Language Models

    May 26, 2026Younghun Go, Jaehoon Han, Changyong Shin +2KV CachingKV-Cache Management

  13. Looped Diffusion Language Models

    May 25, 2026Sanghyun Lee, Chunsan Hong, Seungryong Kim +3Masked Diffusion ModelsDiffusion Language Model Inference

  14. Triplet-Block Diffusion RWKV

    May 25, 2026Ke Lin, Yiyang Luo, Zhaolong Su +2Diffusion Language Model InferenceRecurrent Transformers

  15. Learned Relay Representations for Forward-Thinking Discrete Diffusion Models

    May 21, 2026Benjamin Rozonoyer, Jacopo Minniti, Dhruvesh Patel +4Masked Diffusion ModelsDiffusion Language Model Inference

  16. TIDE: Efficient and Lossless MoE Diffusion LLM Inference with I/O-aware Expert Offload

    May 19, 2026Zhiben Chen, Youpeng Zhao, Yang Sui +2Expert OffloadingLLM Inference Scheduling

  17. Elastic-dLLM: Position Preserving Context Compression and Augmentation of Diffusion LLMs

    May 18, 2026Junyi Wu, Tianchen Zhao, Shaoqiu Zhang +3Masked Diffusion ModelsLong-Context Language Modeling

  18. Prefix-Adaptive Block Diffusion for Efficient Document Recognition

    May 16, 2026Mingxu Chai, Ziyu Shen, Chenyu Liu +9Diffusion Language Model InferenceDiffusion Model Caching

  19. PSD: Pushing the Pareto Frontier of Diffusion LLMs via Parallel Speculative Decoding

    May 15, 2026Shengyin Sun, Yiming Li, Renxi Liu +7Masked Diffusion ModelsSpeculative Decoding for Diffusion Language Models

  20. Adaptive Steering and Remasking for Safe Generation in Diffusion Language Models

    May 13, 2026Yejin Lee, Ungsik Kim, Yo-Sub HanAdversarial Attacks on LLMsDiffusion Language Model Inference

  21. Orthrus: Memory-Efficient Parallel Token Generation via Dual-View Diffusion

    May 12, 2026Chien Van Nguyen, Chaitra Hegde, Van Cuong Pham +3Language Model DecodingDiffusion Language Model Inference

  22. Multi-Token Residual Prediction

    May 12, 2026Yufeng Xu, Zishuo Bao, Qian Wang +6Masked Diffusion ModelsMulti-Token Prediction

  23. TAD: Temporal-Aware Trajectory Self-Distillation for Fast and Accurate Diffusion LLM

    May 10, 2026Haoyang Zhou, Li Kong, Shijie Ren +4Diffusion Model DistillationDiffusion Language Model Inference

  24. Trajectory as the Teacher: Few-Step Discrete Flow Matching via Energy-Navigated Distillation

    May 8, 2026Amin Karimi Monsefi, Dominic Culver, Nikhil Bhendawade +3Flow MatchingDiffusion Language Model Inference