Synthetic Data Augmentation for Speech Recognition

Latest papers 16

All topics
CardsList
  1. Foreground Voice Activity Detection: Learning Speaker Selectivity from Supervision

    Sep 17, 2026Guangzhao Yang, Muhammad Huzaifah, Yu Pan +2Data AugmentationSpeech Processing

  2. Phoneme-guided TTS augmentation for ASR: A unified pipeline and multilingual evaluation

    Aug 27, 2026Zhen Wang, TianRui Wu, RongQi Han +3Synthetic Data AugmentationTTS Synthesis

  3. On the Role of Conversational Timing in Synthetic Training Data for ASR

    Jul 9, 2026Máté Gedeon, Péter MihajlikAutomatic Speech RecognitionSynthetic Data Augmentation for Speech Recognition

  4. LuxSQA: Ask Me in Luxembourgish with TTS-Augmented Spoken Question Answering

    Jul 2, 2026Nina Hosseini-Kivanani, Marco Matassoni, Alessio BruttiSpoken Language UnderstandingSynthetic Data Augmentation

  5. How to Leverage Synthetic Speech for LLM-Based ASR Systems?

    Jun 27, 2026Yanis Labrak, Dairazalia Sanchez-Cortes, Sergio Burdisso +9Synthetic-to-Real Domain AdaptationSynthetic Data Augmentation

  6. Synthetic Audio Generation Framework for Air Traffic Control Speech Recognition

    Jun 19, 2026Raphaël Bagat, Zhe Zhang, Junichi Yamagishi +2Synthetic Data GenerationSpeech Processing

  7. Low-Burden Data Augmentation for Dysarthric ASR via Zero-Shot Voice Cloning

    Jun 18, 2026Satwinder Singh, Qianli Wang, Zihan Zhong +4Synthetic Data AugmentationAutomatic Speech Recognition

  8. Improving End-to-End Speech Recognition for Dysarthric Speech through In-Domain Data Augmentation

    Jun 18, 2026Paban Sapkota, Hemant Kumar Kathania, Sudarsana Reddy Kadiri +1Data AugmentationAutomatic Speech Recognition

  9. Improving Code-Switching ASR with Code-Mixing Guided Synthetic Speech

    Jun 14, 2026Yue Heng Yeo, Haoyang Li, Yizhou Peng +6Code-Switching Speech RecognitionSynthetic Data Augmentation

  10. Multilingual Long-Form Speech Instruction Following: KIT's Submission to IWSLT 2026

    Jun 3, 2026Enes Yavuz Ugan, Maike Züfle, Yuka Ko +5MBR DecodingInstruction Following

  11. Efficient ASR Training with Conversations that Never Happened

    Jun 2, 2026Máté Gedeon, Péter MihajlikSynthetic Data AugmentationAutomatic Speech Recognition

  12. Few-Shot Synthetic Accented Speech for ASR Fine-Tuning: What Helps and When?

    Apr 30, 2026Yurii Halychanskyi, Nimet Beyza Bozdag, Mark Hasegawa-Johnson +2Synthetic-to-Real Domain AdaptationSynthetic Data Augmentation