Diffusion Transformer

Also known as DiT

Momentum

35 papers in the last four weeks, up 169% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 297

All topics
CardsList
  1. Deflating the Hessian: Rank-4 W4A4 Quantization for Multimodal Diffusion Transformers

    Oct 8, 2026Shiwen Wang, Pengxiang Zhao, Xiaoming YuanDiffusion Model QuantizationPost-Training Quantization

  2. iCATS: Fast Video Generation via Interaction-Aware Sparse Attention and Timestep-Adaptive Sparsity

    Oct 8, 2026Chengfeng Han, Baole Ai, Xianlu Bian +4Diffusion Model Inference AccelerationVideo Diffusion Models

  3. ORCA: Hunting Compositional Failures in Text-to-Image Diffusion

    Oct 7, 2026Arshia Hemmat, Amirhossein Vahidi, Amitis Shidani +4Compositional T2I GenerationT2I Diffusion Models

  4. Backend-Agnostic Sparse Attention for Fast High-Resolution Visual Generation

    Oct 6, 2026Liao Ma, Jiayi Song, Yunfeng Wu +2Video Diffusion ModelsDiffusion Transformer

  5. Learning to Read the Contextual Tokens in Diffusion Transformers

    Oct 5, 2026Omer Dahary, Etai Sella, Hadar Averbuch-Elor +2Diffusion Model AlignmentDiffusion Transformer

  6. MC-Sparse: Deconstructing and Closing the Dense-Sparse Attention Gap in Diffusion Transformers

    Oct 5, 2026Jiarui Chen, Zeqiang Lai, Jiangshan Wang +5Video Diffusion ModelsDiffusion Transformer

  7. Level-of-Token Diffusion

    Oct 5, 2026Kiyohiro Nakayama, Brian Chao, Jan Ackermann +5Video Diffusion ModelsDiffusion Transformer

  8. LiFT: Loop Flow Transformers

    Oct 4, 2026Mohammad Mahdi Derakhshani, Pedro M. P. Curvo, Gertjan J. Burghouts +2Diffusion TransformerRecurrent Transformers

  9. Diffusion Transformers are Provably Optimal In-context Generators

    Oct 4, 2026Guoji Fu, Tomoya Wakayama, Ryotaro Kawata +3Diffusion TransformerDiffusion Sampling

  10. Embedding Prediction Helps Image Generation

    Oct 1, 2026Sihan Xu, Ji Xie, Zilin Wang +2Diffusion TransformerConditional Image Generation

  11. PixelDense: Dense Prediction as Representation Alignment for Pixel Diffusion

    Sep 30, 2026Lehan Yang, Daiqing Qi, Wenhao Zhang +9Diffusion Model AlignmentDiffusion Transformer

  12. Looped Diffusion Transformer

    Sep 30, 2026Yong Xien Chng, Tianyi Chen, Wenwen Tong +7Diffusion TransformerRecurrent Transformers

  13. D-Scope: Decomposing and Steering Diffusion Transformers with Sparse Autoencoders

    Sep 30, 2026Xinyue Xu, Jiahao Zhang, Lijie Hu +2Transformer InterpretabilityDiffusion Transformer

  14. PARK: Accurate Block Retrieval for Sparse Attention in Video Diffusion Transformers

    Sep 30, 2026Yun Dai, Jiarui Wen, Huiping Zhuang +2Video Diffusion ModelsDiffusion Transformer

  15. DIET: Deletion-response Expert Trimming for Video Diffusion Transformers

    Sep 29, 2026Jiachang Zhang, Teng Hu, Bohao Feng +4Mixture-of-Experts PruningVideo Diffusion Models

  16. LDM-is-AE: Latent Diffusion Model is an Auto-Encoder for End-to-End Image Generation

    Sep 29, 2026Zhengqiang Zhang, Lingchen Sun, Rongyuan Wu +4Diffusion TransformerLatent Diffusion Models

  17. NowcastDiT: Diffusion Transformers are Effective Precipitation Nowcasters

    Sep 29, 2026Haoran Xu, Xingzhuo Guo, Yuchen Zhang +3Precipitation ForecastingDiffusion Transformer

  18. Motion Concept Unlearning in Video Diffusion Models

    Sep 29, 2026Ping Liu, Chi ZhangVideo Diffusion ModelsDiffusion Transformer

  19. FastVR: Efficient Streaming Video Restoration with One-Step Diffusion

    Sep 29, 2026Xiaoxu Chen, Qin Yang, Haoran Bai +2Diffusion TransformerVideo Restoration

  20. Representation by Design in Generation: Cross-View Class-Token Alignment in Diffusion Transformers

    Sep 28, 2026Xiaoyu Wu, Yifei Wang, Chen WeiFlow MatchingDiffusion Transformer

  21. Persistence Forcing: Exploiting Feature Specialization in Pixel-Space Diffusion

    Sep 28, 2026Chong Wang, Zixuan Fu, Shiqi Huang +3Diffusion TransformerDiffusion Guidance

  22. Scaffold Then Internalize: Representation Injection for Diffusion Transformers

    Sep 28, 2026Han Fu, Jiacheng Chen, Baoquan Zhao +4Diffusion TransformerDiffusion Model Acceleration

  23. What Visual Generators Need from Teachers: Rethinking Representation Alignment

    Sep 28, 2026Yongcong Wang, Hingchin Chen, Mingyu Fan +6Diffusion Model AlignmentDiffusion Transformer