T2I Generation

T2I: Text-to-Image

Momentum

23 papers in the last four weeks, up 156% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 181

All topics
CardsList
  1. UltraText Bench: A Comprehensive Bilingual Benchmark for Evaluating Visual Text Rendering in Image Generation

    Oct 7, 2026Deyuan Liu, Yihao Hu, Jingxuan Zhang +13T2I Generation EvaluationT2I Generation

  2. Harmful Content Generation in Text-to-Image Models: Capabilities and Moderation Limitations

    Oct 5, 2026Paschalis Giakoumoglou, Manos Schinas, Symeon PapadopoulosT2I GenerationContent Moderation

  3. Safe Image Generation via Reinforcement Learning

    Oct 5, 2026Eungyeol Han, Jong-Seok LeeT2I GenerationSafe T2I Generation

  4. SALD: Self-Referenced Advantage Learning for Diffusion Models

    Oct 1, 2026Aryan Das, Surjo Dey, Koushik Biswas +4T2I GenerationConditional Diffusion Models

  5. CLASP: Continual Low-rank Adapters for Spatially Placed Concepts from One Hypernetwork

    Oct 1, 2026Wojciech Gromski, Patryk Krukowski, Jan Miksa +2Subject-Driven Image GenerationT2I Generation

  6. A Matched-Budget Audit Framework for Recaptioned Image-Text Supervision Distributions

    Oct 1, 2026Giyeong Oh, Junghun Park, Yuhan Bae +1VLM EvaluationT2I Generation

  7. Steering Fields: Adaptive Vector Fields for Safe Image Generation and Beyond

    Sep 30, 2026Simone Facchiano, Jan Eric Lenssen, Bernt Schiele +3T2I GenerationSafe T2I Generation

  8. EvoGen-Harness: Learning Where and How to Evolve Image-Generation Harnesses

    Sep 30, 2026Jiabin Luo, Yinan Liu, Chunlei Meng +1T2I GenerationImage Generation

  9. HiRAE: Hierarchical Representation Autoencoding with Residual Budgets

    Sep 29, 2026Xuanyu Zhu, Yan Bai, Yang Shi +5AutoencodersT2I Generation

  10. Decompose Radicals, Then Reward: Fine-Grained Inspection for Accurate Chinese Text Rendering

    Sep 29, 2026Yazhen Xie, Xingsong Ye, Zhineng ChenT2I GenerationRL for Image Generation

  11. PE-OPSD: Internalizing Prompt Enhancement into Flow-matching Models via On-Policy Self-Distillation

    Sep 29, 2026Mingfeng Lin, Chengfei Cai, Lin Xu +3On-Policy Self-DistillationT2I Generation

  12. PreviewDiff: Multimodal Critic-Guided Search over Diffusion Latents

    Sep 28, 2026Vighnesh Subramaniam, Boris Katz, Brian Cheung +3Diffusion Model GuidanceT2I Generation

  13. Unifying Distributional Training for One-Step Visual Generation

    Sep 28, 2026Chi Zhang, Shi Haoyang, Yueyi Liu +9Gaussian Mixture ModelsT2I Generation

  14. FestDPO: Few-step Generator Alignment with Direct Preference Optimization

    Sep 28, 2026Jaewoo Lee, Kyuil Sim, Hyeongyu Kang +3Direct Preference OptimizationT2I Generation

  15. TSGate: Timestep-Aware Gated Attention for Diffusion Transformers

    Sep 28, 2026Boyu Zhang, Yifan Liu, Shuxia Lin +3Diffusion TransformerGated Attention

  16. On the Diffusibility of High-Dimensional Latents

    Sep 23, 2026Chao Feng, Zhiyang Xu, Bowei Chen +7Flow MatchingLatent Diffusion Models

  17. λλ-Controlled GRPO: Turning Flow-Matching Ratio Instability into a Budgeted Resource

    Sep 18, 2026Yufeng Wang, Parivesh Priye, Meeshawn Marathe +1Flow MatchingT2I Generation

  18. Newer Is Not Fairer: Gender Stereotyping in Text-to-Image AI Across Model Generations

    Sep 16, 2026Shesh Narayan Gupta, Nik Bear BrownT2I GenerationDemographic Bias in T2I Models

  19. Prompt Revision as a Source of Cultural Bias in Text-to-Image Systems

    Sep 12, 2026Aleksandra Urman, Elsa Lichtenegger, Salima Jaoua +7T2I GenerationCultural Bias in Language Models

  20. Logit Refiner: Improving Visual Autoregressive Models via Intra-Scale Dependency Modeling

    Sep 12, 2026Meimingwei Li, Stefan Andreas Baumann, Felix Krause +1Visual Autoregressive ModelsT2I Generation

  21. AcFlow: Controlling Text-to-Image Diffusion Transformers via Learned Conditional Activation Flow

    Sep 9, 2026Junran Wang, Zehao Jin, Tianyu Luan +3Diffusion TransformerT2I Generation

  22. SVG-Score: Human-Aligned Evaluation of Text-to-SVG Generation

    Sep 3, 2026Marco Cipriano, Leonardo Zini, Alexandra Schild +5VLM EvaluationHuman Preference Modeling

  23. Blending Concepts: Benchmarking Visual Metaphor Generation in Text-to-Image Models

    Sep 2, 2026Chuer Chen, Zichen Wang, Yi He +2T2I GenerationT2I Generation Evaluation

  24. GlyphAnchor: Enhancing Visual Text Rendering via Position-Anchored Glyph Priors

    Sep 2, 2026Qiang Xiang, Shuang Sun, Binglei Li +4T2I GenerationImage Editing

  25. T2LSC-Bench: Benchmarking Localized Semantic Control in Text-to-Image Generation

    Sep 2, 2026Yan Wang, Xinyi Hou, Weiguo Lin +2T2I GenerationControllable Image Generation

  26. CAT-Flow: Curvature-Adaptive sTeps for Flow Matching

    Sep 1, 2026Qinchan Li, Pedro Cisneros-Velarde, Keru Fu +3Flow MatchingT2I Generation

  27. SpatialGuard: Harness-Guided Verifiable Spatial Reasoning for Text-to-Image Generation

    Sep 1, 2026Ziyun Qian, Zizhi Chen, Yizhou Liu +33D Spatial ReasoningT2I Generation

  28. CANVAS: Consistency-Aware Navigation via Visual Adaptive Sampling for Long-Context Text-to-SVG Generation

    Aug 31, 2026Yichen Wu, Haoxuan Qu, Yihang Lou +2T2I GenerationAdaptive Sampling

  29. ImageEval 2026: Culturally Grounded Arabic Multimodal Evaluation

    Aug 31, 2026Samir Abdaljalil, Hunzalah Hassan Bhatti, Ahlam Bashiti +11Hallucination DetectionT2I Generation

  30. On the Limitations of Cross-Lingual Consistency in Multilingual Text-to-image Generation

    Aug 11, 2026Sicheng Zhang, Zhonghao Yan, Binzhu Xie +4T2I GenerationT2I Generation Evaluation

  31. JustLLMGRPO: Radiographic Control for Chest X-Ray Generation

    Aug 8, 2026Pengxiang Cai, Xiaohan Li, Anglin Liu +3T2I GenerationRL for Image Generation

  32. Beyond Starry Night: Shortcut-Aware Control-State Planning for Artist-Grounded Text to Image Generation

    Aug 7, 2026Kuan Xing, Ye Wang, Changyi Gan +4T2I GenerationImage Generation

  33. Energy-Guided Flow Matching

    Aug 6, 2026Haoyang Tong, Yu He, Fang Li +6Flow MatchingConditional Image Generation

  34. Can Text-to-Image Models Draw from the Right Frame of Reference?

    Aug 4, 2026Zheyuan Gu, Ruihang Li, Yong Huang +5Vision-Language ModelsT2I Generation

  35. Test-Time Scaling for Safe Text-Guided Image Generation via Intermediate Clean Estimates

    Aug 4, 2026Jinya Sakurai, Shueicheng Yan, Xun XuTest-Time OptimizationT2I Generation

  36. Rectify Then Diffuse: Disentangling Concepts Before Denoising Trajectory Unfolds

    Aug 4, 2026Ning Zhu, An Chen, Mengfei Zhao +4T2I GenerationAttention Control in Diffusion Models

  37. CAPEval: A Decoupled Caption Evaluation across Understanding and Generation

    Aug 3, 2026Zhipeng Liu, Haochen Wang, Zhaoxiang ZhangImage CaptioningT2I Generation

  38. Investigating Social Bias in Narrative Image Generation

    Aug 3, 2026Junyeong Park, Sowon Min, Euna Jang +5T2I GenerationDemographic Bias in T2I Models

  39. Mind the Gap: Zero-Query Jailbreaks via Filter-Generator Discrepancy in Text-to-Image Systems

    Aug 2, 2026Wanguang Li, Zhaoxin Wang, Handing WangAdversarial Prompt GenerationT2I Generation

  40. Scaling Properties of Text Conditioning in Visual Generation

    Jul 31, 2026Zilong Chen, Chaorui Deng, Kunchang Li +2T2I GenerationCompositional T2I Generation

  41. GVR-Coder: A Visual-Feedback Framework for Structured SVG Generation in Complex Document and Meeting Scenarios

    Jul 30, 2026Yiming Xu, Jihua Kang, Chunsai Du +5Constrained Generative ModelingT2I Generation

  42. ServerlessT2I: Efficient Text-to-Image Workflow Serving on a Serverless Platform

    Jul 29, 2026Xiaoxiao Jiang, Suyi Li, Sheng Yao +5Efficient Neural Network InferenceT2I Generation

  43. Detecting CSAM Text-to-Image LoRAs From Weights

    Jul 28, 2026David Demitri Africa, Cate Heine, Nadine Staes-Polet +1T2I GenerationLow-Rank Adaptation

  44. OmniPhys: Knowledge-Graph-Driven Benchmarking and Collective Optimization for Physical Commonsense in Text-to-Image Generation

    Jul 28, 2026Yajing Xu, Yarong Lan, Jiaoyan Chen +6T2I GenerationPrompt Optimization for T2I Generation

  45. Harm is not Universal: Community-Specific Toxicity Detection is Urgently Needed

    Jul 27, 2026Xinnuo Xu, Anja Thieme, Daniela Massiceti +6T2I GenerationSafe T2I Generation

  46. FlowCTS: On-policy Continuous Trajectory Supervision of Flow Models

    Jul 27, 2026Kaiyang Ye, Yuan Ge, Junxiang Zhang +8T2I GenerationFlow-Based Generative Modeling

  47. PRISM: Prompt Refinement via Image-grounded Self-rewarding Mechanism for Text-to-Image Generation

    Jul 27, 2026Guo Tang, HongJie Luo, Tianxu Wang +2T2I GenerationRL for Image Generation

  48. One Rewrite to Fix Them All? Type-Aware Repair Allocation for Text-to-Image Prompt Optimization

    Jul 21, 2026Haoyue Liu, Xiaoyu Ma, Ye Chen +2T2I GenerationAutomatic Prompt Optimization

  49. JAGG: Jacobian-Aggregated Group Gradient for Efficient GRPO Training of Diffusion Models

    Jul 20, 2026Ruiyi Ding, Jie Li, He Kang +3BackpropagationDiffusion Transformer

  50. UniNDM: A Unified Noise-driven Detection and Mitigation Framework Against Sexual Content in Text-to-Image Generation

    Jul 18, 2026Yao Huang, Yitong Sun, Huanran Chen +8Diffusion Model GuidanceT2I Generation

  51. Debiasing Text-to-Image Evaluation via Implicit Cultural Alignment Reward Modeling

    Jul 17, 2026Bo-An Chang, Yu-Chih ChenVLM EvaluationReward Modeling