T2I Generation Evaluation

T2I: Text-to-Image

Latest papers 98

All topics
CardsList
  1. It's Always 10:10: Reference Images Break a Bias That Prompts Only Dent

    Oct 8, 2026Luca CazzanigaT2I GenerationT2I Generation Evaluation

  2. False Claims, Credible Images: A Red-Teaming Benchmark for Commercial Image Generators

    Oct 8, 2026Zeyu Ye, Yanchun Li, Sibei He +8Safe T2I GenerationT2I Generation Evaluation

  3. UltraText Bench: A Comprehensive Bilingual Benchmark for Evaluating Visual Text Rendering in Image Generation

    Oct 7, 2026Deyuan Liu, Yihao Hu, Jingxuan Zhang +13T2I Generation EvaluationT2I Generation

  4. Harmful Content Generation in Text-to-Image Models: Capabilities and Moderation Limitations

    Oct 5, 2026Paschalis Giakoumoglou, Manos Schinas, Symeon PapadopoulosT2I GenerationContent Moderation

  5. Evaluating the Evaluators: Diagnosing Large Multimodal Models for AI-Generated Image Assessment

    Sep 29, 2026Yu Zhao, Jiarui Wang, Huiyu Duan +5LLM-as-a-JudgeImage Generation Evaluation

  6. Verifiable Visual Rewards Transfer from Synthetic Scenes to Natural Prompts

    Sep 28, 2026Shuyue Stella Li, Xiaochuang Han, Yulia Tsvetkov +1Compositional T2I GenerationRL for Image Generation

  7. Newer Is Not Fairer: Gender Stereotyping in Text-to-Image AI Across Model Generations

    Sep 16, 2026Shesh Narayan Gupta, Nik Bear BrownT2I GenerationDemographic Bias in T2I Models

  8. Certifying Concept Unlearning in Text-to-Image Diffusion Models

    Sep 14, 2026Mansi, Luca Marzari, Francesco LeofanteDiffusion Model UnlearningConcept Erasure

  9. Prompt Revision as a Source of Cultural Bias in Text-to-Image Systems

    Sep 12, 2026Aleksandra Urman, Elsa Lichtenegger, Salima Jaoua +7T2I GenerationCultural Bias in Language Models

  10. Blending Concepts: Benchmarking Visual Metaphor Generation in Text-to-Image Models

    Sep 2, 2026Chuer Chen, Zichen Wang, Yi He +2T2I GenerationT2I Generation Evaluation

  11. ImageEval 2026: Culturally Grounded Arabic Multimodal Evaluation

    Aug 31, 2026Samir Abdaljalil, Hunzalah Hassan Bhatti, Ahlam Bashiti +11Hallucination DetectionT2I Generation

  12. ContextBias: Controlled Evaluation of Bias Persistence Under Context Shift in Text-to-Image Models

    Aug 30, 2026Shaghayegh Kolli, Sina Emami, Moreno D'Incà +4Demographic Bias in T2I ModelsT2I Generation Evaluation

  13. On the Limitations of Cross-Lingual Consistency in Multilingual Text-to-image Generation

    Aug 11, 2026Sicheng Zhang, Zhonghao Yan, Binzhu Xie +4T2I GenerationT2I Generation Evaluation

  14. Open Evaluation Agent: Efficient and Promptable Evaluation of Visual Generative Models

    Aug 10, 2026Shulin Tian, Ziqi Huang, Fan Zhang +3Tool-Augmented Language Model AgentsAI Agent Evaluation

  15. Math-Vision Diagrams: A Comprehensive Benchmark for Evaluating LLM Mathematical Diagram Generation Capabilities

    Aug 9, 2026Harish Kashyap, Kiran Byadarhaly, Sriram Chakaravarthy +2LLM EvaluationT2I Generation Evaluation

  16. Simile Understanding in Text-to-Image Models: An Evaluation Framework

    Aug 5, 2026Luecheng Wang, Shintaro Ozaki, Hidetaka Kamigaito +4Figurative Language UnderstandingVision-Language Grounding

  17. MultiCompose: Multi-Concept Personalized Composition with Per-Subject Attribute Binding

    Aug 4, 2026Ruirui Zhang, Zhengkai Zhao, Pan GaoImage GenerationCompositional T2I Generation

  18. Can Text-to-Image Models Draw from the Right Frame of Reference?

    Aug 4, 2026Zheyuan Gu, Ruihang Li, Yong Huang +5Vision-Language ModelsT2I Generation

  19. Investigating Social Bias in Narrative Image Generation

    Aug 3, 2026Junyeong Park, Sowon Min, Euna Jang +5T2I GenerationDemographic Bias in T2I Models

  20. NuclearDiffusion: Text-to-Image Foundation Models for Learning Nuclear Energy Concepts

    Aug 1, 2026Mohammed I. Radaideh, Jeremy Moon, Andre Gala-Garza +3Domain AdaptationDiffusion Model Fine-Tuning

  21. Scaling Properties of Text Conditioning in Visual Generation

    Jul 31, 2026Zilong Chen, Chaorui Deng, Kunchang Li +2T2I GenerationCompositional T2I Generation

  22. OmniPhys: Knowledge-Graph-Driven Benchmarking and Collective Optimization for Physical Commonsense in Text-to-Image Generation

    Jul 28, 2026Yajing Xu, Yarong Lan, Jiaoyan Chen +6T2I GenerationPrompt Optimization for T2I Generation

  23. LU-500: A Logo Benchmark for Concept Unlearning

    Jul 27, 2026Keyu Li, Jin Gao, Jialing Zhang +1Diffusion Model UnlearningConcept Erasure

  24. ExpertVerse: A General-Purpose Benchmark for Expert-Level Reasoning in Knowledge-Intensive Visual Synthesis

    Jul 21, 2026Yuan Wang, Yongchao Du, Mengting Chen +4Image GenerationRL for Image Generation