Low-Resource Speech Recognition

Latest papers 77

All topics
CardsList
  1. VSRo-200: A Romanian Visual Speech Recognition Dataset for Studying Supervision and Multimodal Robustness

    Jul 9, 2026Iulia-Maria Udrea, Alexandra Diaconu, Bogdan AlexeMultimodal RobustnessVisual Speaker Recognition

  2. From Sinhala to Dhivehi: Cross-Lingual Transfer Learning for Low-Resource Speech Recognition

    Jul 7, 2026Lukmal Ilyas, Nevidu JayatillekeContinued PretrainingLow-Resource Speech Recognition

  3. Jointly Improving Dialect Identification and ASR in Indian Languages using Multimodal Feature Fusion

    Jul 3, 2026Saurabh Kumar, Amartyaveer, Prasanta Kumar GhoshMulti-Task LearningMultimodal Fusion

  4. From Monolingual to Multilingual: Evaluating Mamba for ASR in South African Languages

    Jul 1, 2026Jesujoba O. Alabi, Julian Herreilers, Badr M. Abdullah +1ASR EvaluationLow-Resource Language Processing

  5. Tone-Conditioned Curriculum Learning for Low-Resource Bantu Speech Recognition

    Jun 30, 2026Kesego Mokgosi, Vukosi Marivate, Sitwala Mundia +3Automatic Speech RecognitionLow-Resource Speech Recognition

  6. Building an ASR Solution for Training and Assessing Children's Reading

    Jun 30, 2026Yacouba Diarra, Nouhoum Souleymane Coulibaly, Mamadou Dembele +2Automatic Speech RecognitionLow-Resource Speech Recognition

  7. Dziri Voicebot: An End-to-End Low-Resource Speech-to-Speech Conversational System for Algerian Dialect

    Jun 24, 2026Dihia Lanasri, Rebeh Imane Ammar Aouchiche, Abdelkarim Remmide +2TTS SynthesisSpoken Dialogue Systems

  8. From Speech to Text Corpora: Evaluating ASR-Based Data Acquisition for Low-Resource Fongbe and Hausa

    Jun 20, 2026Mahounan Pericles Adjovi, Victor Olufemi, Roald Eiselen +1Automatic Speech RecognitionLow-Resource Language Processing

  9. Error-Aware TF-IDF Retrieval-Augmented Generation for ASR Error Correction

    Jun 19, 2026Mohammad Aref Jafari-RaddaniRetrieval-Augmented GenerationAutomatic Speech Recognition

  10. Synthetic Audio Generation Framework for Air Traffic Control Speech Recognition

    Jun 19, 2026Raphaël Bagat, Zhe Zhang, Junichi Yamagishi +2Synthetic Data GenerationSpeech Processing

  11. Low-Burden Data Augmentation for Dysarthric ASR via Zero-Shot Voice Cloning

    Jun 18, 2026Satwinder Singh, Qianli Wang, Zihan Zhong +4Synthetic Data AugmentationAutomatic Speech Recognition

  12. Improving End-to-End Speech Recognition for Dysarthric Speech through In-Domain Data Augmentation

    Jun 18, 2026Paban Sapkota, Hemant Kumar Kathania, Sudarsana Reddy Kadiri +1Data AugmentationAutomatic Speech Recognition

  13. Improving low-resource ASR using bilingual fine-tuning with language identification: a cross-linguistic evaluation

    Jun 16, 2026Reihaneh Amooie, Yun Hao, Wietse de Vries +3Fine-TuningLanguage Identification

  14. Pretrained self-supervised speech models can recognize unseen consonants

    Jun 10, 2026Chihiro Taguchi, Éric Le Ferrand, Hirosi Nakagawa +4Automatic Speech RecognitionSelf-Supervised Speech Representation Learning

  15. Gumbel-BEARD: Automatic Layer Selection for Self-Supervised Adaptation of Whisper in Low-Resource Domains

    Jun 9, 2026Zilai Wang, Natarajan Balaji Shankar, Mohan Shi +2Domain Adaptation for ASRDomain Adaptation

  16. Overcoming Decoder Inconsistencies in Whisper for Dravidian and Low-Resource Languages

    Jun 8, 2026Chowdam Venkata Kumar, Kumud Tripathi, Pankaj WasnikAttention MechanismsLow-Resource Language Processing

  17. Efficient ASR Training with Conversations that Never Happened

    Jun 2, 2026Máté Gedeon, Péter MihajlikSynthetic Data AugmentationAutomatic Speech Recognition

  18. WAXAL-NET: Finetuned Edge ASR Across 19 African Languages

    Jun 1, 2026Victor Tolulope Olufemi, Oreoluwa Babatunde, Ramsey Njema +28ASR EvaluationDomain Adaptation for ASR

  19. Scaling Conversational Hungarian ASR: The BEA-Dialogue+ Corpus

    May 29, 2026Máté Gedeon, Piroska Zsófia Barta, Péter Mihajlik +1Automatic Speech RecognitionLow-Resource Speech Recognition

  20. Building Community-Centred NLP Resources for Puno Quechua

    May 27, 2026Elwin Huaman, Adrian Gamarra Lafuente, Johanna Cordova +1Automatic Speech RecognitionLow-Resource Language Processing

  21. FSA-GRPO: Teaching Auditory LLMs to Use Few-shot Demonstrations

    May 26, 2026Haolong Zheng, Siyin Wang, Xulin Fan +2RL for Language ModelsFew-Shot Domain Adaptation

  22. FalAR: A Large-scale Speaker-Annotated European Portuguese Speech Corpus of Parliamentary Sessions

    May 26, 2026Francisco Teixeira, Carlos Carvalho, Mariana Julião +7Automatic Speech RecognitionLow-Resource Speech Recognition

  23. Thaka at KSAA-2026 Task 2: Regularized Fine-Tuning for Arabic Speech Diacritization

    May 25, 2026Meshal Alamr, Hassan Alqaeri, Abdullah AldahlawiFine-TuningArabic NLP