Multi-Image Editing Benchmarks

Momentum

1 paper in the last four weeks, down 67% on the four weeks before. 0.0% of all new papers.

Jul 6Week of Sep 21

Latest papers 42

All topics
CardsList
  1. Do MLLM Judges Judge the Edit? Auditing Bias in Image Editing Evaluation with Verified Quality Preservation

    Oct 1, 2026Yuan Huang, Zirui Song, Xiuying ChenLarge Language Model JudgesMulti-Image Editing Benchmarks

  2. VIEScore2: Unified Image Evaluation with Spatially Grounded Explanations

    Oct 1, 2026Xianda Du, Max Ku, Weiming Ren +5Multi-Image Editing BenchmarksSynthetic Image Detection

  3. InfoEdit: Probing Global Layout Reasoning in Infographic Editing

    Sep 27, 2026Cheng Yang, Chufan Shi, Huijuan Wang +6Multi-Image Editing BenchmarksLayouts

  4. Capacity Confounds and Coverage Guarantees in Adaptive Sub-model Federated Learning

    Aug 7, 2026Alireza Moayedikia, Alicia Troncoso LoraFederated LearningLong-Run Coverage Guarantees

  5. COMEX: A Composition-Grounded Benchmark and Learning Framework for Explainable Aesthetic Image Cropping

    Aug 4, 2026Rui Yang, Wei Zhou, Dingyong Gou +5CroppingMulti-Image Editing Benchmarks

  6. MIEScore: Human-Aligned Evaluation for Multi-Source Image Editing

    Aug 3, 2026Zitong Xu, Huiyu Duan, Xinyun Zhang +7Multi-Image Editing BenchmarksImage Editing

  7. EEG-EditBench: Probing Visual Information in EEG-Image Retrieval Models with Controlled Image Edits

    Jul 30, 2026Kaifan Zhang, Lihuo He, Yuqi Ji +4Multi-Image Editing BenchmarksBird

  8. MPIE-Bench: Benchmarking Anatomically Plausible Multi-Person Interaction Editing

    Jul 30, 2026Jiajia Lin, Mingxuan Du, Tuowen Zhou +2Multi-Image Editing BenchmarksHuman Mesh Recovery

  9. BG-REAL: A Public Real-Data Anchored Benchmark for Background Manipulation Detection and Localization

    Jul 28, 2026Bugra Alperen Uluirmak, Rifat KurbanMultimedia ForensicsMulti-Image Editing Benchmarks

  10. MEDit-Bench: A Dataset for Evaluating Message-Driven Narrative Video Editing

    Jul 28, 2026Katsuya Ogata, Zongshang Pang, Mayu Otani +1Video EditingMulti-Image Editing Benchmarks

  11. MuViSeg: Multi-View Segment Correspondences from Dense Geometry Priors

    Jul 20, 2026Denis Fatykhoph, Timur Akhtyamov, Konstantin Pakulev +2Multi-ViewAmodal Segmentation

  12. ChartSync: A Benchmark for Visuo-Logical Cascading Chart Editing

    Jul 11, 2026Jiakang Yu, Yixuan Chai, Tianci Wang +7Multi-Image Editing BenchmarksRenderer

  13. Does AI Understand Imaging? A Systematic Benchmark of Agentic AI for Computational Imaging Tasks

    Jul 8, 2026Ethan Chung, Chuanjun Zheng, Jasper Tan +3Multi-Image Editing BenchmarksMultimodal Benchmarks

  14. Beyond Pixel Diffs: Benchmarking Image Change Captioning for Web UI Visual Regression Testing

    Jul 2, 2026Licheng Zhang, Bach Le, Pengtao Zhao +1Image Difference CaptioningMulti-Image Editing Benchmarks

  15. Accelerating Hierarchical Sparse Predictive Coding with Hybrid Amortized Inference

    Jun 26, 2026Kazuhisa FujitaPredictive CodingMulti-Image Editing Benchmarks

  16. Scaling Multi-Reference Image Generation with Dynamic Reward Optimization

    Jun 25, 2026Wenwang Huang, Yusen Fu, Junjie Wang +6Multi-Reference Image GenerationMulti-Image Editing Benchmarks

  17. Do Image Editing Models Understand Lighting?

    Jun 25, 2026Tim Küchler, Johann-Friedrich Feiden, Matthias Nießner +1LightingMulti-Image Editing Benchmarks

  18. An Extensive Benchmark for Single-round and Multi-round Instruction-based Image Editing

    Jun 14, 2026Yiwei Ma, Ke Ye, Weihuang Lin +4Multi-Image Editing BenchmarksImage Editing

  19. Food-R1: A Unified Multi-Task Food Vision-Language Model with Reinforcement Learning

    Jun 3, 2026Yu Zhu, Yongkang Li, Wenjie Zhu +5DietRecent Vision-Language Models

  20. TECCI: Tricky Edits of Collected and Curated Images

    May 31, 2026Aishwarya Agrawal, Roy Hirsch, Yasumasa Onoe +2Multi-Image Editing BenchmarksImage Editing

  21. PaintBench: Deterministic Evaluation of Precise Visual Editing

    May 29, 2026Kai Xu, Ellis Brown, Shrikar Madhu +3Multi-Image Editing BenchmarksImage Editing

  22. Benchmarking and Enhancing Text-to-Image Models for Generating Visual Representations in Early Arithmetic Education

    May 29, 2026Junling Wang, Boqi Chen, Heejin Do +3Text-To-ImageMulti-Image Editing Benchmarks

  23. PhysEditBench: A Protocol-Conditioned Benchmark for Dense Physical-Map Prediction with Image Editors

    May 13, 2026Jiaxin Yang, Yu Hou, Muxin Liu +5Multi-Image Editing BenchmarksImage Editing

  24. FraudBench: A Multimodal Benchmark for Detecting AI-Generated Fraudulent Refund Evidence

    May 9, 2026Xinyu Yan, Boyang Chen, Jiaming Zhang +12Ai-Generated Image DetectionAuthenticity

  25. RewardHarness: Self-Evolving Agentic Post-Training

    May 9, 2026Yuxuan Zhang, Penghui Du, Bo Li +11Progress Reward ModelingMulti-Image Editing Benchmarks

  26. How Far Is Document Parsing from Solved? PureDocBench: A Source-Traceable Benchmark across Clean, Degraded, and Real-World Settings

    May 8, 2026Zhiheng Li, Zongyang Ma, Jiaxian Chen +12Document ParsingMulti-Image Editing Benchmarks

  27. ReasonEdit: Towards Interpretable Image Editing Evaluation via Reinforcement Learning

    May 8, 2026Honghua Chen, Zitong Xu, Huiyu Duan +3Multi-Image Editing BenchmarksImage Editing

  28. DiffCap-Bench: A Comprehensive, Challenging, Robust Benchmark for Image Difference Captioning

    May 6, 2026Yuancheng Wei, Haojie Zhang, Linli Yao +7Image Difference CaptioningMulti-Image Editing Benchmarks

  29. StableI2I: Spotting Unintended Changes in Image-to-Image Transition

    May 6, 2026Jiayang Li, Shuo Cao, Xiaohui Li +6Multi-Image Editing BenchmarksPerceptual Quality

  30. VEFX-Bench: A Holistic Benchmark for Generic Video Editing and Visual Effects

    Apr 17, 2026Xiangbo Gao, Sicong Jiang, Bangya Liu +12Video EditingMulti-Image Editing Benchmarks

  31. VTEdit-Bench: A Comprehensive Benchmark for Multi-Reference Image Editing Models in Virtual Try-On

    Mar 12, 2026Xiaoye Liang, Zhiyuan Qu, Mingye Zou +4Virtual Try-OnMulti-Image Editing Benchmarks

  32. TIIF-Bench: How Does Your T2I Model Follow Your Instructions?

    Jun 2, 2025Xinyu Wei, Jinrui Zhang, Zeqing Wang +4Modern Text-To-Image ModelsText-To-Image