Visual Fidelity

Momentum

10 papers in the last four weeks, up 43% on the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 82

All topics
CardsList
  1. SpecSem-Net: Integrating Spectral and Semantic Features for Robust AI-generated Video Detection

    May 17, 2026Zixi Wei, Huixuaun Zhang, Xiaojun WanAi-Generated Video DetectionGenerative Video Models

  2. MAVEN A Multi-Agent Framework for Multicultural Text-to-Video Generation

    May 16, 2026Shuowei Li, Yuming Zhao, Parth Bhalerao +1Text-To-Video Generation ModelVisual Fidelity

  3. MechVerse: Evaluating Physical Motion Consistency in Video Generation Models

    May 14, 2026Rahul Jain, Mayank Patel, Asim Unmesh +1Video GenerationKinematics

  4. NICE FACT: Diagnosing and Calibrating VLMs in Quantitative Reasoning for Kinematic Physics

    May 8, 2026Jian Lan, Zhicheng Liu, Xinpeng Wang +5Ava-VlmStable Spatial Understanding

  5. LENS: Low-Frequency Eigen Noise Shaping for Efficient Diffusion Sampling

    May 8, 2026Haewon Jeon, Si-Hyeon LeeDiffusion ModelsDiffusion Sampling

  6. RealCam: Real-Time Novel-View Video Generation with Interactive Camera Control

    May 7, 2026Youcan Xu, Jiaxin Shi, Zhen Wang +5Autoregressive Video GenerationReal-Time Systems

  7. Beyond Visual Fidelity: Benchmarking Super-Resolution Models for Large-Scale Remote Sensing Imagery via Downstream Task Integration

    May 1, 2026Zhili Li, Kangyang Chai, Zhihao Wang +6Hyperspectral Image Super-ResolutionRemote Sensing

  8. AesRM: Improving Video Aesthetics with Expert-Level Feedback

    Apr 30, 2026Yujin Han, Yujie Wei, Yefei He +7AestheticsGenerative Video Models

  9. Breaking Watermarks in the Frequency Domain: A Modulated Diffusion Attack Framework

    Apr 24, 2026Chunpeng Wang, Binyan Qu, Xiaoyu Wang +4WatermarksDiffusion Models

  10. Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models

    Apr 23, 2026Mohammed Safi Ur Rahman Khan, Sanjay Suryanarayanan, Tushar Anand +1Large Language Model EvaluationBlind Spots

  11. Evian: Towards Explainable Visual Instruction-tuning Data Auditing

    Apr 22, 2026Zimu Jia, Mingjie Xu, Andrew Estornell +1Recent Vision-Language ModelsData Quality

  12. FlowC2S: Flowing from Current to Succeeding Frames for Fast and Memory-Efficient Video Continuation

    Apr 19, 2026Hovhannes Margaryan, Quentin Bammey, Christian SandorContinuationVisual Fidelity

  13. Splats in Splats++: Robust and Generalizable 3D Gaussian Splatting Steganography

    Apr 17, 2026Yijia Guo, Wenkai Huang, Tong Hu +9Steganography3D Generation

  14. Is This Edit Correct? A Multi-Dimensional Benchmark for Reasoning-Aware Image Editing

    Apr 16, 2026Yixuan Ding, Wei Huang, Ruijie Quan +2Image EditingEdit

  15. Cross-Resolution Distribution Matching for Diffusion Distillation

    Mar 6, 2026Feiyang Chen, Hongpeng Pan, Haonan Xu +3Visual FidelityDistributions

  16. When Pretty Isn't Useful: Investigating Why Modern Text-to-Image Models Fail as Reliable Training Data Generators

    Feb 23, 2026Krzysztof Adamkiewicz, Brian Bernhard Moser, Stanislav Frolov +3Modern Text-To-Image ModelsSynthetic Training Data

  17. PhysChoreo: Physics-Controllable Video Generation with Part-Aware Semantic Grounding

    Nov 25, 2025Haoze Zhang, Tianyu Huang, Zichen Wan +4Generative Video ModelsVideo Generation

  18. SEBA: Sample-Efficient Black-Box Attacks on Visual Reinforcement Learning

    Nov 12, 2025Tairan Huang, Yulin Jin, Junxu Liu +2Black-Box Adversarial AttacksOffline Reinforcement Learning