Cross-Lingual Voice Cloning

Momentum

7 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 31

All topics
CardsList
  1. A barrier or a booster? Familiarity effects on Mandarin emotion prosody recognition using AI-powered voice cloning

    Sep 30, 2026Feng Xu, Gaoyuan Zhang, Shanshan Xue +4Cross-Lingual Voice CloningProsody

  2. TTS-Guard: Black-Box Ownership Verification of Text-to-Speech Models via Adaptive Adversarial Speaker-Pair Fingerprints

    Sep 20, 2026Xubin Yue, Zhenhua Xu, Zhebo Wang +5Cross-Lingual Voice CloningF5-Tts

  3. Cross-Lingual F5-TTS 2: A Simplified Framework for Language-Agnostic Voice Cloning

    Sep 14, 2026Qingyu Liu, Rixi Xu, Yushen Chen +11Cross-Lingual Voice CloningF5-Tts

  4. CVSS-X: A Multilingual Speech-to-Speech Translation Corpus for 28 Languages

    Sep 11, 2026Lucas Rafael Stefanel Gris, Alef Iury Siqueira Ferreira, Frederico Santos de Oliveira +4Speech TranslationCross-Lingual Voice Cloning

  5. Zero-Shot Temporal Localisation of Audio Deepfakes in Multi-Speaker Conversations

    Sep 9, 2026Soumyadeep RoyDeepfake DetectionCross-Lingual Voice Cloning

  6. Building and Evaluating Fixed-Voice Thai TTS from Synthetic Speech

    Sep 3, 2026Kunat Pipatanakul, Potsawee Manakul, Warit Sirichotedumrong +3Cross-Lingual Voice CloningProsody

  7. CuteTTS: Efficient and High-Quality Speech Synthesis via Autoregressive Modeling of Continuous Latents

    Aug 9, 2026Yuqian Zhang, Yao Shi, Kexin Huang +6Autoregressive Text-To-SpeechCross-Lingual Voice Cloning

  8. Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning

    Jul 24, 2026Roseline Polle, Owen Parsons, George Fairs +5Cross-Lingual Voice CloningParalinguistic Cues

  9. DETECT-3B-Omni is Agnostic of Content and Demographics

    Jul 3, 2026Nicolas M. Müller, Aditya Tirumala Bukkapatnam, Dominik Schnieders +1SpeakerCross-Lingual Voice Cloning

  10. ProsoCodec: Prosody-Oriented Speech Codec for Voice Conversion

    Jun 20, 2026Jeongsoo Choi, Ji-Hoon Kim, Shujie Hu +1Neural Speech CodecsProsody

  11. Low-Burden Data Augmentation for Dysarthric ASR via Zero-Shot Voice Cloning

    Jun 18, 2026Satwinder Singh, Qianli Wang, Zihan Zhong +4Cross-Lingual Voice CloningDysarthric Speech

  12. DuraMark: Duration-Embedded Watermarking in LLM-based TTS

    Jun 13, 2026Zhenwei Mou, Weili Jiang, Liping Chen +4Flow-Matching Text-To-SpeechCross-Lingual Voice Cloning

  13. Vocal Identity Under Siege by AI Voice Cloning Technologies

    Jun 11, 2026Jyh-An Lee, Xuan SunCross-Lingual Voice CloningVoice Conversion

  14. BareWave: Waveform-Native Flow-Matching Text-to-Speech

    Jun 8, 2026Wei Fan, Chao-Hong Tan, Qian Chen +5Flow-Matching Text-To-SpeechCross-Lingual Voice Cloning

  15. KIT's Submission to Cross-Lingual Voice Cloning in IWSLT 2026

    Jun 5, 2026Seymanur Akti, Alexander WaibelCross-Lingual Voice CloningMultilingual Automatic Speech Recognition

  16. VoxCPM2 Technical Report

    Jun 5, 2026Yixuan Zhou, Guoyang Zeng, Xin Liu +15Cross-Lingual Voice CloningTechnical Report

  17. PilotTTS: A Disciplined Modular Recipe for Competitive Speech Synthesis

    May 26, 2026Bowen Li, Shaotong Guo, Zhen Wang +11Autoregressive Text-To-SpeechSpeech Synthesis

  18. Voice "Cloning" is Style Transfer

    May 15, 2026Kaitlyn Zhou, Federico Bianchi, Martijn Bartelds +3Cross-Lingual Voice CloningVoice Conversion

  19. X-Voice: Enabling Everyone to Speak 30 Languages via Zero-Shot Cross-Lingual Voice Cloning

    May 7, 2026Rixi Xu, Qingyu Liu, Haitao Li +10Cross-Lingual Voice CloningMultilingual Automatic Speech Recognition

  20. Toward Fine-Grained Speech Inpainting Forensics:A Dataset, Method, and Metric for Multi-Region Tampering Localization

    May 4, 2026Tung Vu, Yen Nguyen, Hai Nguyen +2Audio Deepfake DetectionCross-Lingual Voice Cloning

  21. JaiTTS: A Thai Voice Cloning Model

    Apr 30, 2026Jullajak Karnjanaekarin, Pontakorn Trakuekul, Narongkorn Panitsrisit +5Cross-Lingual Voice CloningAutoregressive Text-To-Speech

  22. One Voice, Many Tongues: Cross-Lingual Voice Cloning for Scientific Speech

    Apr 28, 2026Amanuel Gizachew Abebe, Yasmin MoslemCross-Lingual Voice CloningMultilingual Automatic Speech Recognition

  23. Acoustic and perceptual differences between standard and accented speech and their voice clones

    Apr 2, 2026Tianle Yang, Chengzhe Sun, Phil Rose +1Cross-Lingual Voice CloningVoice Conversion

  24. RVCBench: Benchmarking the Robustness of Voice Cloning Across Modern Audio Generation Models

    Jan 31, 2026Ruinan Jin, Xinting Liao, Hanlin Yu +2Cross-Lingual Voice CloningVoice Conversion

  25. Spectral Masking and Interpolation Attack (SMIA): A Black-box Adversarial Attack against Voice Authentication and Anti-Spoofing Systems

    Date pendingKamel Kamel, Hridoy Sankar Dutta, Keshav Sood +1SpoofingCross-Lingual Voice Cloning