Audio-Visual Synchronization

Momentum

10 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 42

All topics
CardsList
  1. HighSync: High-Quality Lip Synchronization via Latent Diffusion Models

    May 16, 2026Saeid Firouzi Daghigh, Majid Iranpour Mobarakeh, Mostafa Alavi +1Audio-Visual SynchronizationAudio-Driven Facial Animation

  2. OmniNFT: Modality-wise Omni Diffusion Reinforcement for Joint Audio-Video Generation

    May 12, 2026Guohui Zhang, XiaoXiao Ma, Jie Huang +9Audio-Video GenerationAudio-Visual Synchronization

  3. Unison: Harmonizing Motion, Speech, and Sound for Human-Centric Audio-Video Generation

    May 9, 2026Shihao Cheng, Jiaxu Zhang, Quanyue Song +6Audio-Video GenerationAudio-Visual Synchronization

  4. TMD-Bench: A Multi-Level Evaluation Paradigm for Music-Dance Co-Generation

    May 3, 2026Xiaoda Yang, Majun Zhang, Changhao Pan +10Human Motion GenerationAudio-Visual Synchronization

  5. Mutual Forcing: Dual-Mode Self-Evolution for Fast Autoregressive Audio-Video Character Generation

    Apr 28, 2026Yupeng Zhou, Lianghua Huang, Zhifan Wu +7Audio-Video GenerationLong-Horizon Video Generation

  6. EAD-Net: Emotion-Aware Talking Head Generation with Spatial Refinement and Temporal Coherence

    Apr 25, 2026Yahui Li, Yinfeng Yu, Liejun Wang +1Video Diffusion ModelsAudio-Visual Synchronization

  7. SyncEdit: Rethinking Lip Synchronization as Editing with Audio-Driven Diffusion Models

    Mar 10, 2026Lixiang Lin, Siyuan Jin, Jinshan ZhangVideo EditingAudio-Visual Synchronization

  8. EmbedTalk: Talking Head Synthesis using Gaussian Embeddings

    Mar 8, 2026Arpita Saggar, Jonathan C. Darling, Duygu Sarikaya +13D Gaussian SplattingTalking Head Generation

  9. SyncVoice: Simple and Effective Automatic Video Dubbing with Vision-Augmented TTS

    Nov 23, 2025Kaidi Wang, Yi He, Wenhao Guan +9TTS SynthesisAudio-Visual Synchronization

  10. Taming Text-to-Sounding Video Generation via Advanced Modality Condition and Interaction

    Oct 3, 2025Kaisi Guan, Xihua Wang, Zhengfeng Lai +5Audio-Video GenerationVideo Diffusion Models