Diffusion Transformer

Also known as DiT

Momentum

35 papers in the last four weeks, up 169% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 297

All topics
CardsList
  1. UniCSG: Unified High-Fidelity Content-Constrained Style-Driven Generation via Staged Semantic and Frequency Disentanglement

    Apr 20, 2026Jingwei Yang, Ruoxi Wu, Wei Shen +4Constrained Generative ModelingDiffusion Transformer

  2. Hierarchical Codec Diffusion for Video-to-Speech Generation

    Apr 17, 2026Jiaxin Ye, Gaoxiang Cong, Chenhui Wang +4Audio-Video GenerationDiffusion Transformer

  3. Brain-DiT: A Universal Multi-state fMRI Foundation Model with Metadata-Conditioned Pretraining

    Apr 14, 2026Junfeng Xia, Wenhao Ye, Xuanye Pan +3Medical Imaging Foundation ModelsDiffusion Transformer

  4. Crystalite: A Lightweight Transformer for Efficient Crystal Modeling

    Apr 2, 2026Tin Hadži Veljković, Joshua Rosenthal, Ivor Lončarić +1Diffusion TransformerTransformer

  5. SHARP: Spectrum-aware Highly-dynamic Adaptation for Resolution Promotion in Remote Sensing Synthesis

    Mar 23, 2026Bingxuan Zhao, Qing Zhou, Chuang Yang +1Rotary Positional EmbeddingsDiffusion Transformer

  6. WiT: Waypoint Diffusion Transformers for Alleviating Trajectory Conflict in Pixel-Space Image Generation

    Mar 16, 2026Hainuo Wang, Mingjia Li, Xiaojie GuoFlow MatchingDiffusion Transformer

  7. PDE-SSM: A Spectral State Space Approach to Spatial Mixing in Diffusion Transformers

    Mar 14, 2026Eshed Gal, Moshe Eliasof, Eldad HaberDiffusion TransformerVisual SSMs

  8. AccelAes: Accelerating Diffusion Transformers for Training-Free Aesthetic-Enhanced Image Generation

    Mar 13, 2026Xuanhua Yin, Chuanzhi Xu, Haoxian Zhou +2Diffusion TransformerImage Generation

  9. RAE-NWM: Navigation World Model in Dense Visual Representation Space

    Mar 10, 2026Mingkun Zhang, Wangtian Shen, Fan Zhang +3Visual NavigationWorld Model Learning

  10. Spectral and Trajectory Regularization for Diffusion Transformer Super-Resolution

    Mar 6, 2026Jingkai Wang, Yixin Tang, Jue Gong +6Diffusion TransformerDiffusion Model Distillation

  11. TerraDiT: Point-Conditioned Diffusion Transformer for Satellite Image Synthesis

    Mar 2, 2026Srikumar Sastry, Dan Cher, Brian Wei +4Diffusion TransformerControllable Image Generation

  12. DiTS: Multimodal Diffusion Transformers Are Time Series Forecasters

    Feb 6, 2026Haoran Zhang, Haixuan Liu, Yong Liu +4Time Series ForecastingProbabilistic Time Series Forecasting

  13. Shiva-DiT: Residual-Based Differentiable Top-kk Selection for Efficient Diffusion Transformers

    Feb 5, 2026Jiaji Zhang, Hailiang Zhao, Jiaju Wu +3Diffusion Model AccelerationDiffusion Transformer

  14. Mixture of Distributions Matters: Dynamic Sparse Attention for Efficient Video Diffusion Transformers

    Jan 14, 2026Yuxi Liu, Yipeng Hu, Zekun Zhang +2Video Diffusion ModelsDiffusion Transformer

  15. SnapGen++: Unleashing Diffusion Transformers for Efficient High-Fidelity Image Generation on Edge Devices

    Jan 13, 2026Dongting Hu, Aarush Gupta, Magzhan Gabidolla +12Diffusion TransformerDiffusion Model Distillation

  16. TexTailor: Inference-Time Textual Guidance Tailoring for Multimodal Diffusion Transformers

    Jan 5, 2026Binglei Li, Mengping Yang, Zhiyu Tan +2Diffusion TransformerCompositional T2I Generation

  17. EMAG: Self-Rectifying Diffusion Sampling with Exponential Moving Average Guidance

    Dec 19, 2025Ankit Yadav, Ta Duc Huy, Lingqiao LiuDiffusion Model GuidanceClassifier-Free Guidance

  18. Phase-Aligned RoPE for Mixed-Resolution Diffusion Transformer

    Nov 24, 2025Haoyu Wu, Jingyi Xu, Qiaomu Miao +2Rotary Positional EmbeddingsVideo Diffusion Models

  19. RefAM: Attention Magnets for Zero-Shot Referral Segmentation

    Sep 26, 2025Anna Kukleva, Enis Simsar, Alessio Tonioni +4Zero-Shot LearningImage Segmentation

  20. NABLA: Neighborhood Adaptive Block-Level Attention

    Jul 17, 2025Dmitrii Mikhailov, Aleksey Letunovskiy, Maria Kovaleva +6Video Diffusion ModelsDiffusion Transformer

  21. Conditioning Residuals for Diffusion Models via Representation Feedback

    May 16, 2025Weilai Xiang, Hongyu Yang, Di Huang +1Representation LearningDiffusion Transformer

  22. UniLayDiff: A Unified Diffusion Transformer for Content-Aware Layout Generation

    Date pendingZeyang Liu, Le Wang, Sanping Zhou +4Diffusion TransformerConditional Generative Modeling