Diffusion Transformer

Also known as DiT

Momentum

35 papers in the last four weeks, up 169% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 297

All topics
CardsList
  1. TSGate: Timestep-Aware Gated Attention for Diffusion Transformers

    Sep 28, 2026Boyu Zhang, Yifan Liu, Shuxia Lin +3Diffusion TransformerGated Attention

  2. KiT: A Foundation Model for Financial Time-Series Forecasting using DiffusionTransformers

    Sep 28, 2026Boyu Zhang, Haorui LiDiffusion TransformerFinancial Forecasting

  3. Residual-Stream Burden Shapes Representation Learning in Diffusion Transformers

    Sep 27, 2026Tongtong Liang, Siqi Kou, Ziqiao Xi +6Diffusion TransformerResidual Learning

  4. GeoShrink: Accelerating Diffusion Transformers with Two Lines of Code

    Sep 27, 2026Haosen Li, Wenshuo Chen, Shaofeng Liang +3Video Diffusion ModelsDiffusion Transformer

  5. Fill2SR: Repurposing Inpainting Diffusion Transformers for Real-World Super-Resolution

    Sep 27, 2026Xingfu Yi, Xiaoxue YuDiffusion Models for Image RestorationDiffusion Transformer

  6. In-Token Learning for High-Fidelity Image Restoration via Diffusion Transformers

    Sep 27, 2026Xingfu Yi, Xiaoxue YuImage-to-Image TranslationDiffusion Transformer

  7. PulseQuant: Propagation-Guided Subspace Correction for 4-Bit Video Diffusion Transformers

    Sep 27, 2026Yutong Wang, Xingtong Ge, Enhuai Liu +4Video Diffusion ModelsDiffusion Transformer

  8. PixelDiT2: Representation-Grounded Pixel Diffusion Transformers

    Sep 21, 2026Yongsheng Yu, Wei Xiong, Yichen Sheng +2Diffusion Model GuidanceDiffusion Transformer

  9. SlotDiT: Object-Centric Representations for Diffusion Transformers

    Sep 15, 2026Gjergj Plepi, Sven BehnkeDiffusion TransformerLatent Diffusion Models

  10. VC-Attention: Value Smoothing and Softmax Casting for Low-bit Attention

    Sep 14, 2026Xingyang Li, Dongyun Zou, Shining Zhang +8Video Diffusion ModelsDiffusion Transformer

  11. Exploring Diffusion Transformers for Cross-Modal Augmentation in Multimodal Brain State Decoding

    Sep 12, 2026Ziwei Wang, Xingyi He, Hongbin Wang +3Data AugmentationDiffusion Transformer

  12. AcFlow: Controlling Text-to-Image Diffusion Transformers via Learned Conditional Activation Flow

    Sep 9, 2026Junran Wang, Zehao Jin, Tianyu Luan +3Diffusion TransformerT2I Generation

  13. Marigold V2: Revisiting Diffusion Transformers for Monocular Depth Estimation

    Sep 8, 2026Igor Pavlovic, Thiemo Wandel, Anton Obukhov +6Diffusion TransformerOOD Generalization

  14. RoLA: Rotary-Positioned Low-Rank Linear Attention for Efficient Diffusion Transformers

    Sep 6, 2026Zekun Zhang, Yixiang Cai, Yuxi Liu +9Rotary Positional EmbeddingsLow-Rank Attention

  15. SPARK: Input-Conditioned Sparse Activation Modulation for Frozen DiT-based Super-Resolution

    Sep 3, 2026Federico Putamorsi, Leonardo Zini, Marcella Cornia +1Diffusion Models for Image RestorationDiffusion Transformer

  16. LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes

    Sep 3, 2026Chuyan Chen, Haoxing Chen, Kun Chen +27Diffusion TransformerT2I Diffusion Models

  17. GlyphAnchor: Enhancing Visual Text Rendering via Position-Anchored Glyph Priors

    Sep 2, 2026Qiang Xiang, Shuang Sun, Binglei Li +4T2I GenerationImage Editing

  18. Beyond Attention Masks: Instruction Anchoring for Efficient In-Context Diffusion Generation

    Aug 21, 2026Yangshuai Liu, Zheming Li, Jiaao Li +4Diffusion TransformerDiffusion Model Caching

  19. Spatially-Grounded Text-to-Video Generation via Inference-Time Gradient-Free Optimization

    Aug 13, 2026Guillaume Jeanneret, Mathis Koroglu, Hugo Caselles-Dupré +2Diffusion TransformerText-to-Video Generation

  20. LoSA: Near-Lossless Sparse Attention for Training-Free Video Diffusion Acceleration

    Aug 12, 2026Enhuai Liu, Yunke Wang, Yutong Wang +2Video Diffusion ModelsDiffusion Transformer

  21. LiveAnimate: Stable Long-Form Streaming Human Animation in Real-Time

    Aug 12, 2026Yuxuan Zhang, Haozhong Xiong, Yubo Huang +6Diffusion TransformerReal-Time Interactive Video Generation

  22. Unveiling the Secret of AdaLN-Zero in Diffusion Transformer

    Aug 10, 2026Jie Zhu, Mingyu Ding, Boqiang Duan +2Diffusion TransformerNeural Network Initialization

  23. BAG: Budget-Aware Gating for Diffusion Caching

    Aug 10, 2026Tong Zhao, Mingkun Lei, Yucheng Han +1Diffusion TransformerDiffusion Model Caching

  24. Representation-driven Endoscopic Visual Embedding Alignment for Latent Generation

    Aug 7, 2026Francisco Caetano, Tim J. M. Jaspers, Haiko Middeljans +7EndoscopyDiffusion Transformer