Diffusion Transformer

Also known as DiT

Momentum

35 papers in the last four weeks, up 169% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 297

All topics
CardsList
  1. EquiVLA: A General Framework for Rotationally Equivariant Vision-Language-Action Models

    Jun 18, 2026Thien-Loc Ha, Quang-Tan Nguyen, Trong-Bao Ho +8Robot Policy LearningDiffusion Transformer

  2. Spotlight: Synergizing Seed Exploration and Spot GPUs for DiT RL Post-Training

    Jun 17, 2026Ruiqi Lai, Dakai An, Wei Gao +6Diffusion TransformerRL for Image Generation

  3. AoiZora: Topology-Aware Auto-Parallel Optimization for Inference of Diffusion Transformers

    Jun 16, 2026Kaijian Wang, Yuanyuan Xu, Fanjiang Ye +5AI Accelerator InferenceVideo Diffusion Models

  4. Pulling The REINS: Training-Free Safety Alignment of Video Diffusion Models via Representation Steering

    Jun 15, 2026Rohit Kundu, Arindam Dutta, Sarosij Bose +2Diffusion Model AlignmentVideo Diffusion Models

  5. MMDiff: Extending Diffusion Transformers for Multi-Modal Generation

    Jun 15, 2026Yagmur Akarken, Orest Kupyn, Christian RupprechtDiffusion TransformerDepth Estimation

  6. UniDDT: Unifying Multimodal Understanding and Generation with Decoupled Diffusion Transformer

    Jun 15, 2026Shuai Wang, Liang Li, Yang Chen +3Diffusion TransformerUnified Multimodal Models

  7. MoECa: Aligning Feature Reuse with Expert Decomposition in Diffusion Transformers

    Jun 14, 2026Maoliang Li, Haojing Chen, Jiayu Chen +4Diffusion TransformerDiffusion Model Caching

  8. Robots as Tokens: Unified Diffusion Transformer for Coordinated Multi-Robot Trajectory Generation

    Jun 14, 2026Ruofei Bai, Jie Chen, Yuxin Cai +3Multi-Robot Motion PlanningConstrained Motion Planning

  9. Towards a Unified Generative Model for Scarce Time Series with Domain Experts

    Jun 13, 2026Zihao Yao, Qi Zheng, Jiankai Zuo +1Diffusion TransformerTime Series Generation

  10. Modality Forcing for Scalable Spatial Generation

    Jun 11, 2026Bardienus Pieter Duisterhof, Deva Ramanan, Jeffrey Ichnowski +2Diffusion TransformerMonocular Depth Estimation

  11. World Tracing: Generative Pixel-Aligned Geometry Beyond the Visible

    Jun 11, 2026Hao Zhang, Mohamed El Banani, Jen-Hao Cheng +6Diffusion Transformer3D Reconstruction

  12. GF-DiT: Scheduling Parallelism for Diffusion Transformer Serving

    Jun 11, 2026Xinwei Qiang, Yifan Hu, Shixuan Sun +6Diffusion TransformerDiffusion Model Serving

  13. Diffusion Transformer World-Action Model for AV Scene Prediction

    Jun 11, 2026Ruslan Sharifullin, Benjamin Jiang, Kai Xi ChewAction-Conditioned Video GenerationDiffusion Transformer

  14. Flow Matching with In-Context Priors for Out-of-Distribution Brain Dynamics

    Jun 10, 2026Sam Gijsen, Michał Łukomski, Marc-André Schulz +1Diffusion TransformerTime Series Generation

  15. Making Time Editable in Video Diffusion Transformers

    Jun 8, 2026Konstantin Kuklev, Viacheslav Vasilev, Alexander Kunitsyn +2Video Diffusion ModelsDiffusion Transformer

  16. AHA-WAM:Asynchronous Horizon-Adaptive World-Action Modeling with Observation-Guided Context Routing

    Jun 8, 2026Jisong Cai, Long Ling, Shiwei Chu +10Long-Horizon Robotic ManipulationWorld Models for Robotics

  17. LiteVSR: Lightweight Adaptation of Frozen Diffusion Transformers for Video Super-Resolution

    Jun 8, 2026Yu Cao, Ziquan Liu, Zhensong Zhang +3Video Diffusion ModelsDiffusion Transformer

  18. MeanVC 2: Robust Low-Latency Streaming Zero-Shot Voice Conversion

    Jun 8, 2026Guobin Ma, Yuxuan Xia, Yuepeng Jiang +6Diffusion TransformerAudio Diffusion Models

  19. MaskAlign: Token-Subset Representation Alignment for Efficient Diffusion Training

    Jun 7, 2026Lianyu Pang, Tianlin Pan, Cheng Da +5Diffusion Model AlignmentDiffusion Transformer

  20. TrioPose: Native Triple-Stream Diffusion Transformers for Pose-Guided Text-to-Image Generation

    Jun 5, 2026Dian Gu, Zhengyi YangDiffusion TransformerT2I Generation

  21. Unified Safe In-context Image Generation in Multimodal Diffusion Transformers via Restricting Unsafe Information Flows

    Jun 5, 2026Xiang Yang, Feifei Li, Mi Zhang +4Diffusion TransformerImage Generation