Diffusion Transformer

Also known as DiT

Momentum

35 papers in the last four weeks, up 169% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 297

All topics
CardsList
  1. Breaking the Lock-in: Diversifying Text-to-Image Generation via Representation Modulation

    Jun 5, 2026Dahee Kwon, Haeun Lee, Jaesik ChoiDiffusion TransformerT2I Generation

  2. Style-CCL: Content-Preserving Style Transfer via Curriculum Continual Learning

    Jun 4, 2026Shiwen Zhang, Haoyuan Wang, Xianghao Zang +3Diffusion TransformerContinual Learning

  3. Multimodal Action Diffusion for Robust End-to-End Autonomous Driving

    Jun 1, 2026Jorge Daniel Rodríguez-Vidal, Diego Porres, Gabriel Villalonga Pineda +1Diffusion TransformerEnd-to-End Autonomous Driving

  4. FocusDiT: Masking Queries in Diffusion Transformers for Fine-grained Image Generation

    Jun 1, 2026Xueji Fang, Liyuan Ma, Jianhao Zeng +3Diffusion TransformerImage Generation

  5. Chameleon: Style-Content Disentangled Framework for Cross-Domain Object Compositing

    May 31, 2026Sukhun Ko, Jeahun Sung, Soo Ye Kim +1Diffusion TransformerCompositional Image Generation

  6. MedSyn2: Flexible Control of 3D CT Generation via Text and Semantically-Defined Segmentation Prompts

    May 31, 2026Weicheng Dai, Chenyu Wang, Binxu Li +4Diffusion TransformerConditional Image Generation

  7. COLLAR: Cascaded Object-Level Latent Refinement for High-Fidelity Conditional Generation

    May 31, 2026Xinlong Zhang, Jia Wei, Xiaoyu Zhang +3Diffusion TransformerConditional Diffusion Models

  8. Improving Visual Representation Alignment Generation with GRPO

    May 30, 2026Shentong Mo, Sukmin YunDiffusion Model AlignmentDiffusion Transformer

  9. UniVerse: A Unified Modulation Framework for Segmentation-Free,Disentangled Multi-Concept Personalization

    May 29, 2026Quynh Phung, Sandesh Ghimire, Minsi Hu +2Diffusion TransformerImage Generation

  10. TunerDiT: Training-free Progressive Steering of Diffusion Transformer for Multi-Event Video Generation

    May 29, 2026Ruotong Liao, Guowen Huang, Qing Cheng +6Diffusion TransformerText-to-Video Generation

  11. Veda: Scalable Video Diffusion via Distilled Sparse Attention

    May 28, 2026Shihao Han, Hao Yang, Xinting Hu +3Video Diffusion ModelsDiffusion Transformer

  12. Robust and Generalizable Safety Steering for Text-to-Image Diffusion Transformers

    May 28, 2026Zihao Xue, Yan Wang, Zhen Bi +7Diffusion TransformerDomain Generalization

  13. PARE: Pruning and Adaptive Routing for Efficient Video Generation

    May 26, 2026Yutong Wang, Yunke Wang, Tianfan Xue +4Video Diffusion ModelsDiffusion Transformer

  14. Equivalent Flows, Unequal Learning: Clean-Latent Prediction in Transformers

    May 26, 2026Funing Fu, Tenghui Wang, Guanyu Zhou +2Flow MatchingDiffusion Transformer

  15. SoftCap: Soft-Budget Control for Diffusion Transformer Acceleration

    May 26, 2026Yuhang Zhang, Junxiang Qiu, Huixia Ben +3Diffusion TransformerDiffusion Model Caching

  16. Timestep-Aware SVDQuant-GPTQ for W4A4 Quantization of Wan2.2-I2V

    May 26, 2026Junhao Wu, Dezhong Yao, Hai JinVideo Diffusion ModelsDiffusion Transformer

  17. RT-Lynx: Putting the GEMM Sparsity In a Right Way for Diffusion Models

    May 26, 2026Xing Cong, Hanlin Tang, Kan Liu +3Diffusion TransformerActivation Sparsity

  18. Where Concept Erasure Should Occur: Concept-Layer Alignment in Text-to-Video Diffusion Models

    May 25, 2026Yiwei Xie, Ping Liu, Zheng ZhangVideo Diffusion ModelsDiffusion Transformer

  19. Diffusion Image Generation with Explicit Modeling of Data Manifold Geometry

    May 25, 2026Duoduo Xue, Zhiyu Zhu, Junhui HouDiffusion TransformerDiffusion Model Sampling

  20. Blocked Gibbs meets Diffusion Transformers: Unsupervised Learning for Constraint Optimization

    May 24, 2026Yudong W. Xu, Wenhao Li, Xiaoyu Wang +2Diffusion TransformerConstrained Optimization

  21. Trajectory-Consistent Calibration for Cache-Accelerated Diffusion Models

    May 24, 2026Mingyu Liang, Dingkun Xu, Jingwei XuDiffusion TransformerDiffusion-Based Image Generation

  22. Reasoning to Align: Implicit Reasoning in Diffusion Transformers for Video Editing

    May 23, 2026Yan Li, Lin Liu, Xiaopeng Zhang +1Video Diffusion ModelsDiffusion Transformer

  23. SEGA: Spectral-Energy Guided Attention for Resolution Extrapolation in Diffusion Transformers

    May 21, 2026Javad Rajabi, Kimia Shaban, Koorosh Roohi +2Rotary Positional EmbeddingsDiffusion Model Guidance

  24. Rethinking Token Reduction for Diffusion Models via Output-Similarity-Awareness

    May 21, 2026Hangyeol Lee, Hyojeong Lee, Joo-Young KimDiffusion TransformerDiffusion-Based Image Generation