cs.CVOct 1, 2026

Rethinking Memorization Mitigation in Diffusion Models: Reinforcing Text Conditioning

Authors: Hyungjun Joo, Sehwan Kim, Hyeonggeun Han, Sangwoo Hong, Jungwoo Lee

Organizations: Seoul National University · Konkuk University

Abstract

Text-to-image diffusion models have achieved remarkable progress in image synthesis, yet can exhibit memorization by closely reproducing individual training examples. Effective mitigation must preserve useful prompt information to guide alternative depictions. We introduce a training-free method that redistributes cross-attention with Gaussian smoothing before reinforcing content-token contributions and attenuating padding contributions, without additional denoiser evaluations. With this intervention, stronger content conditioning can improve prompt alignment at comparable training-image similarity. A local analysis identifies when reinforcement preserves shared value information while redistribution reduces localized attention mass. On Stable Diffusion v1.4 and v2.0, all evaluated smoothing widths lie on the empirical Pareto frontiers for training-image similarity versus both prompt alignment and image preference. A configuration selected on Stable Diffusion reduces template reproduction in DeepFloyd IF without further tuning. These findings support jointly controlling conditioning allocation and strength to generate prompt-consistent alternatives.

Figures & tables

Appendix figures & tables18 assets

Supplementary material from the paper’s appendix.

Appendix

Explore similar work

CardsList
  1. Broken Memories: Detecting and Mitigating Memorization in Diffusion Models with Degraded Generations

    May 21, 2026Yuanmin Huang, Mi Zhang, Chen Chen +4Diffusion ModelsMemorization

  2. DICE: Distilling Classifier-Free Guidance into Text Embeddings

    Feb 6, 2025Zhenyu Zhou, Defang Chen, Can Wang +2Text-To-Image Diffusion ModelsMulti-Reference Image Generation

  3. Injecting Image Guidance into Text-Conditioned Diffusion Models at Inference

    May 24, 2026Agata Żywot, Iason Skylitsis, Thijmen Nijdam +4Text-To-Image Diffusion ModelsText-Conditioned Diffusion Model