Controllable Image Generation

Latest papers 125

All topics
CardsList
  1. QuadTok: Quadtree Visual Tokenizer for Autoregressive Image Generation

    Oct 7, 2026Yucheng Mao, Zeyuan Chen, Xiaojun Shan +4Visual TokenizationAutoregressive Image Generation

  2. OverLay++: Dense-Overlap Layout-to-Image Generation Dataset

    Oct 6, 2026Shivansh Aggarwal, Shresth Grover, Divyansh Srivastava +7Image GenerationControllable Image Generation

  3. On Color Alignment in VAE Latent Spaces and Its Applications

    Oct 5, 2026Julian D. Santamaria, Kai Wang, Jesús Malo +2Variational AutoencodersImage Generation

  4. Safe Image Generation via Reinforcement Learning

    Oct 5, 2026Eungyeol Han, Jong-Seok LeeT2I GenerationSafe T2I Generation

  5. Controllable Road Marking Generation

    Oct 5, 2026Zhiyu, Cai, Yufan Zhang +3HD Map ConstructionControllable Image Generation

  6. Steering Fields: Adaptive Vector Fields for Safe Image Generation and Beyond

    Sep 30, 2026Simone Facchiano, Jan Eric Lenssen, Bernt Schiele +3T2I GenerationSafe T2I Generation

  7. VIF-Bench: Evaluating Visual Instruction Following in Multi-Reference Image Generation

    Sep 29, 2026Yuta Oshima, Masakazu Yoshimura, Masahiro Suzuki +2Image GenerationCompositional Image Generation

  8. CapField-OPD: Learning Continuous Capability Fields via Joint-Anchored Multi-Teacher On-Policy Distillation for Flow Models

    Sep 28, 2026Pengyang Ling, Jiazi Bu, Yujie Zhou +6Generative Flow NetworksMulti-Teacher Knowledge Distillation

  9. Beyond Emotion Prompts: Fine-Grained Text-to-Image Generation Driven by Valence-Arousal-Dominance

    Sep 21, 2026Minglang Li, Yueyue Fang, Xieping GaoConditional Image GenerationControllable Image Generation

  10. Paint-Anything: Unified Any-Color Control for Image Generation and Editing

    Sep 17, 2026Ji Xie, Dewei Zhou, Xinyu Huang +2Text-Guided Image EditingImage Editing

  11. Multimodal Conditioning of Fine-Tuned Stable Diffusion XL for Controllable and Culturally Faithful Ulos Motif Generation

    Sep 16, 2026Humasak Simanjuntak, Tamara Yunika Sianipar, Bronson T. M Siallagan +2Latent Diffusion ModelsImage Generation

  12. Balancing Emotional Alignment and Semantic Consistency in Image Generation via Reinforcement Learning with Valence-Arousal Anchoring

    Sep 14, 2026Jisheng Dang, Zhenxuan Wang, Bin Li +3Conditional Image GenerationImage Generation

  13. An End-to-End Automated Pipeline for Controllable Crack Data Synthesis

    Sep 11, 2026Conghui Li, Muxin Pu, Chern Hong Lim +2Synthetic Data AugmentationLearning with Noisy Labels

  14. AcFlow: Controlling Text-to-Image Diffusion Transformers via Learned Conditional Activation Flow

    Sep 9, 2026Junran Wang, Zehao Jin, Tianyu Luan +3Diffusion TransformerT2I Generation

  15. T2LSC-Bench: Benchmarking Localized Semantic Control in Text-to-Image Generation

    Sep 2, 2026Yan Wang, Xinyi Hou, Weiguo Lin +2T2I GenerationControllable Image Generation

  16. SpatialGuard: Harness-Guided Verifiable Spatial Reasoning for Text-to-Image Generation

    Sep 1, 2026Ziyun Qian, Zizhi Chen, Yizhou Liu +33D Spatial ReasoningT2I Generation

  17. AnaDiffusion: Anatomically CompositionalLatent Diffusion for Controllable 3D Brain MRI Generation

    Aug 24, 2026Huiwen Han, Lulin Liu, Bangya Liu +8Compositional Image GenerationMedical Image Synthesis

  18. WithEveryone: Unified Planning and Identity Grounding for Group Image Generation

    Aug 20, 2026Hengyuan Xu, Qixun Wang, Yiji Cheng +5Subject-Driven Image GenerationImage Generation

  19. Evaluation of Clinically Steerable Retinal Image Generation from Foundation Model Latent Spaces

    Aug 13, 2026Zuzanna A. Wakefield-Skórniewska, Bartłomiej W. PapieżSynthetic-to-Real Domain AdaptationMedical Imaging Foundation Models

  20. Erase but Preserve: Controllable Removal of Copyrighted Animation Characters via Optimized Semantic Anchors

    Aug 13, 2026Qiao Li, Xiaomeng Fu, Wangjia Yu +4Diffusion Model UnlearningControllable Image Generation

  21. Beyond Starry Night: Shortcut-Aware Control-State Planning for Artist-Grounded Text to Image Generation

    Aug 7, 2026Kuan Xing, Ye Wang, Changyi Gan +4T2I GenerationImage Generation

  22. CSGen: A Multi-Domain Curvilinear Structure Generation Model via Hierarchical Multimodal Diffusion

    Aug 5, 2026Zhe Shan, Ziming Yang, Lei Zhou +3Image GenerationConditional Generative Modeling

  23. DAC-Pose: Dual-Agent Collaborative Framework for Pose-Guided Human Generation

    Aug 5, 2026Haotian Yang, Zhile Yang, Huiyu Zhou +1Conditional Image GenerationAgentic Image Generation

  24. Dual Inversion for Text-to-Image Diffusion Models: From Both Prompt and Noise Perspectives

    Jul 29, 2026Xiaolong Liu, Junjian Li, Yuan Xiao +4Diffusion Model InversionDiffusion-Based Inverse Problems

  25. PriSAR: 3D Geometric-Prior-Guided Diffusion for Parameter-Controlled SAR Image Generation

    Jul 25, 2026Fan Zhang, Xuanting Wu, Fei Ma +2Diffusion Model GuidanceDiffusion-Based Image Generation

  26. Appearance Pointers -- Multimodal Region Control of Diffusion Transformers

    Jul 21, 2026Rahul Sajnani, Yulia Gryaditskaya, Radomír Měch +2Diffusion TransformerConditional Image Generation