Compositional T2I Generation

T2I: Text-to-Image

Momentum

6 papers in the last four weeks, against 1 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 61

All topics
CardsList
  1. ORCA: Hunting Compositional Failures in Text-to-Image Diffusion

    Oct 7, 2026Arshia Hemmat, Amirhossein Vahidi, Amitis Shidani +4Compositional T2I GenerationT2I Diffusion Models

  2. Form and Void: Entangled Composition through an Autonomous AI Agent

    Oct 1, 2026Shiwen Wang, Jian Yang, Xu Wang +2Image GenerationCompositional Image Generation

  3. CAST: Causal Advantage-Structured Training with Spatially Grounded Compositional Rewards for Diffusion Models

    Sep 30, 2026Shu Yu, Chaochao LuDiffusion Model Fine-TuningCompositional T2I Generation

  4. EvoGen-Harness: Learning Where and How to Evolve Image-Generation Harnesses

    Sep 30, 2026Jiabin Luo, Yinan Liu, Chunlei Meng +1T2I GenerationImage Generation

  5. Verifiable Visual Rewards Transfer from Synthetic Scenes to Natural Prompts

    Sep 28, 2026Shuyue Stella Li, Xiaochuang Han, Yulia Tsvetkov +1Compositional T2I GenerationRL for Image Generation

  6. SpatialGuard: Harness-Guided Verifiable Spatial Reasoning for Text-to-Image Generation

    Sep 1, 2026Ziyun Qian, Zizhi Chen, Yizhou Liu +33D Spatial ReasoningT2I Generation

  7. Coherence-Oriented Dream Scene Visualisation

    Aug 5, 2026Azra Açıl, Simon ColtonImage GenerationCompositional T2I Generation

  8. MultiCompose: Multi-Concept Personalized Composition with Per-Subject Attribute Binding

    Aug 4, 2026Ruirui Zhang, Zhengkai Zhao, Pan GaoImage GenerationCompositional T2I Generation

  9. Can Text-to-Image Models Draw from the Right Frame of Reference?

    Aug 4, 2026Zheyuan Gu, Ruihang Li, Yong Huang +5Vision-Language ModelsT2I Generation

  10. Rectify Then Diffuse: Disentangling Concepts Before Denoising Trajectory Unfolds

    Aug 4, 2026Ning Zhu, An Chen, Mengfei Zhao +4T2I GenerationAttention Control in Diffusion Models

  11. Scaling Properties of Text Conditioning in Visual Generation

    Jul 31, 2026Zilong Chen, Chaorui Deng, Kunchang Li +2T2I GenerationCompositional T2I Generation

  12. ETPDesigner: Multi-Agent Orchestration for Interactive Multimodal Electronic Theater Program

    Jul 22, 2026Mengtian Li, Xinru Guo, Xiaoru Lin +3Multi-Agent OrchestrationCompositional T2I Generation

  13. Tree-of-Thoughts Reasoning for Text-to-Image In-Context Learning

    Jul 8, 2026Stepanida Alekseeva, Jenifer Kalafatovich, Seong-Whan LeeTree of ThoughtsMultimodal ICL

  14. RADIANCE: Relative Adaptive Denoising with IP-Adapter for Novel Concept Enhancement

    Jul 6, 2026Zi-Xiang Ni, Bo-Lun Huang, Teng-Fang Hsiao +2Diffusion Model GuidanceT2I Generation

  15. Learning to Generate Multiple Objects from Dense and Occluded Layouts

    Jul 3, 2026Bach-Hoang Ngo, Si-Tri Ngo, Hieu Le +1Image GenerationCompositional Image Generation

  16. COMPASS: Grounding Composition-Intent Guidance in Unified Multimodal Models

    Jun 27, 2026Ziqi Zhou, Weize Quan, Mining Tan +6Multimodal GroundingUnified Multimodal Models

  17. IV-CoT: Implicit Visual Chain-of-Thought for Structure-Aware Text-to-Image Generation

    Jun 23, 2026Zixuan Li, Haokun Lin, Yicheng Xiao +10T2I GenerationMultimodal Large Language Models

  18. ELDiff: When Evidential Learning Meets Text-to-Image Diffusion

    Jun 18, 2026Qingtao Pan, Kai Ye, Zhihao Dou +2T2I GenerationCompositional T2I Generation

  19. STEDiff: Strengthening Text Embedding for Text-to-Image Alignment in Diffusion Model

    Jun 9, 2026Hailan Zhang, Haipeng Liu, Bo Fu +1Text EmbeddingsText-Image Alignment

  20. Training-Free Multi-Concept LoRA Composition with Prompt-Aware Weighting

    Jun 2, 2026Georgios Tsoumplekas, Stella Bounareli, Vasileios ArgyriouSubject-Driven Image GenerationCompositional T2I Generation

  21. Text-to-Image Models Need Less from Text Encoders Than You Think

    Jun 2, 2026Nurit Spingarn, Noa Cohen, Tamar Rott Shaham +1Text EmbeddingsConditional Image Generation

  22. OctoT2I: A Self-Evolving Agentic Text-to-Image Router

    Jun 1, 2026Xu Jiang, Bin Chen, Gehui Li +3T2I GenerationAgentic Image Generation

  23. APE: Agentic Prompt Enhancer for Image Generation and Editing

    May 29, 2026Zijian Huang, Jay Zhangjie Wu, Zian Wang +5Text-Guided Image EditingT2I Generation