Multilingual Automatic Speech Recognition

Latest papers 84

All topics
CardsList
  1. BabelFake: A Multilingual Audio-Visual DeepFake Benchmark

    Oct 5, 2026Carlotta Segna, Joel Tschesche, Anna RohrbachMultilingual BenchmarkMultilingual Automatic Speech Recognition

  2. Code-Switching Spoken Language Identification as Multi-Label Set Prediction

    Oct 1, 2026Shunsuke Mitsumori, Matthew Wiesner, Shigeo Morishima +1Code-SwitchingMultilingual Automatic Speech Recognition

  3. Benchmarking Automatic Speech Recognition Tools for Iberian Languages

    Sep 29, 2026Fernando López, Pablo Gómez, David Solans +2Automatic Speech Recognition EvaluationMultilingual Automatic Speech Recognition

  4. CARDAMOM: A Micro-Dialectal Arabic Speech Dataset for ASR

    Sep 28, 2026Bashar Talafha, Samar M. Magdy, Aisha Alansari +36DialectsMultilingual Automatic Speech Recognition

  5. Adaptive Fisher-Whitened Cross-Covariance for Low-Resource Speech Recognition

    Sep 24, 2026Asmee Mishra, Mengjie Qian, Brechtje Post +1Multilingual Automatic Speech RecognitionLow-Rank Structure

  6. YODAS v3: Over 1 Million Hours of High-Bandwidth, Stereophonic, Multilingual Speech

    Sep 24, 2026William Chen, Shinnosuke Takamichi, Sayaka Shiota +3Multilingual Automatic Speech RecognitionText Corpora

  7. The Second MLC-SLM Challenge: Multilingual Conversational Speech Diarization, Recognition, and Understanding

    Sep 23, 2026Bingshen Mu, Mingchen Shao, Zhennan Lin +7Multilingual Automatic Speech RecognitionSpeaker Diarization

  8. Isolated Sign Language Recognition for Icelandic Sign Language: Experiments in a Low-resource Setting

    Sep 22, 2026Finnur Ágúst Ingimundarson, Guðný Björk Þorvaldsdóttir, Mathias Müller +1Sign Language TranslationMultilingual Automatic Speech Recognition

  9. Federated Multilingual Speech-LLMs: Architecture and Aggregation Strategy Benchmarking

    Sep 20, 2026Jordi Luque, Aleix Sant, Fernando LópezMultilingual Automatic Speech RecognitionSpeech Encoder

  10. A Cross-Lingual Acoustic Disease-Alignment Framework for Respiratory Health Assessment from Spontaneous Speech

    Sep 16, 2026Roksana Khanom, Raghib Asfak Tasnim, Bodrun Nahar Bithi +4Respiratory Sound ClassificationMultilingual Automatic Speech Recognition

  11. Language Orthogonalization for Zero-Shot Cross-Lingual Audio Deepfake Detection

    Sep 15, 2026Minu Kim, Ji Sub Um, Hoirin KimSelf-Supervised Speech ModelsMultilingual Automatic Speech Recognition

  12. Sequential Adapter Stacking for Cross-Lingual Low-Resource ASR

    Sep 14, 2026Thai Thi Thanh Thao Dang, Mengjie Qian, Kate KnillMultilingual Automatic Speech RecognitionAutomatic Speech Recognition

  13. Tone on a Budget: A Reference-Free Metric for Lexical Tone in Massively Multilingual Text-to-Speech

    Sep 13, 2026Moses Daudu, Adeola Enitan Bamidele, Honor-Jesus BezaleelSeed-Tts-Eval BenchmarkCharacter Error Rate

  14. Orukeet: Multilingual ASR with Frozen Gabor Kernels

    Sep 9, 2026Nathan Roll, Irene Yi, Büşra Marşan +6Multilingual Automatic Speech RecognitionAutomatic Speech Recognition

  15. Phrase-Localized Language-Contrastive Guidance: Training-Free Localized Accent Control for Code-Switching Text-to-Speech

    Sep 1, 2026Che Hyun Lee, Sangkwon Park, Donghun Kang +4Code-SwitchingMultilingual Automatic Speech Recognition

  16. DonorRank: Donor Language Selection for Low-Resource Cross-Lingual Speech Recognition

    Aug 11, 2026Akriti Dhasmana, Aarohi Srivastava, David ChiangMultilingual Automatic Speech RecognitionLow-Resource Languages

  17. Latent Softmax for Data-Efficient Phoneme-Based Multilingual ASR Across Tonal and Non-Tonal Languages

    Aug 2, 2026Saierdaer Yusuyin, Nanling Jiang, Hao Huang +1Multilingual Automatic Speech RecognitionGrapheme-To-Phoneme

  18. A Cross-lingual Comparison of Human and Classification Model Entrainment Behavior in Code-switched Speech Settings

    Jul 28, 2026Debasmita Bhattacharya, Siying Ding, Alayna Nguyen +1Code-SwitchingMultilingual Automatic Speech Recognition

  19. MoLGE: Mixture of Language Group Experts for Efficient Scaling of Massively Multilingual Speech Recognition

    Jul 27, 2026Sangmin Lee, Woojin Chung, Woongjib Choi +1Multilingual Automatic Speech RecognitionMultilingual Language Models

  20. Indic DiarBench: A Multilingual Joint Diarization and ASR Benchmark for Indian Languages

    Jul 26, 2026Deovrat Mehendale, Aditya Mehndiratta, Dhruv Rathi +2Speaker DiarizationMultilingual Automatic Speech Recognition

  21. Synthetic Speech, Real Signal: Paralinguistic Preservation and Cross-Lingual Augmentation via Voice Cloning

    Jul 24, 2026Roseline Polle, Owen Parsons, George Fairs +5Cross-Lingual Voice CloningParalinguistic Cues

  22. MEUSLI: a Multilingual Projector for LLM-based ASR and Beyond

    Jul 24, 2026Lorenzo Concina, Seraphina Fong, Marco Matassoni +1Multilingual Automatic Speech RecognitionSpeech Translation

  23. Unified Gradient Projection: Language-Balanced Continual Learning for Multilingual Low-Resource ASR

    Jul 13, 2026Ziang Ren, Guodong Lin, Yuchen Ai +2Multilingual Automatic Speech RecognitionWhisper-Large-V3

  24. GigaAM Multilingual: Foundation Model for Underrepresented Languages

    Jul 11, 2026Andrei Kuzmenko, Alexandr Maximenko, Aleksandr Kutsakov +5Multilingual Automatic Speech RecognitionLow-Resource Languages

  25. Which Languages Transfer Best to Warlpiri? A Similarity-Based Study for Low-Resource ASR

    Jul 11, 2026Pravina Mylvaganam, Eliathamby Ambikairajah, Ting Dang +2Multilingual Automatic Speech RecognitionCross-Lingual Transfer

  26. Diarization-Guided Qwen-ASR Adaptation for Multilingual Two-Speaker Conversational Speech

    Jul 9, 2026Hao Wu, RongQi Han, Zhen Wang +2Multilingual Automatic Speech RecognitionSpeaker Diarization

  27. From Sinhala to Dhivehi: Cross-Lingual Transfer Learning for Low-Resource Speech Recognition

    Jul 7, 2026Lukmal Ilyas, Nevidu JayatillekeMultilingual Automatic Speech RecognitionCross-Lingual Transfer

  28. Progressive Refinement: An Iterative Pseudo-Labeling Approach for Mandarin-English Code-Switching ASR

    Jul 6, 2026Qu Yang, Cakra Wardhana, Tim NgCode-SwitchingMultilingual Automatic Speech Recognition

  29. Jointly Improving Dialect Identification and ASR in Indian Languages using Multimodal Feature Fusion

    Jul 3, 2026Saurabh Kumar, Amartyaveer, Prasanta Kumar GhoshMultilingual Automatic Speech RecognitionAutomatic Speech Recognition

  30. Towards a Phonology-Informed Evaluation of Multilingual TTS

    Jul 2, 2026Sneha Ray Barman, Neeraj Kumar Sharma, Shakuntala MahantaGrapheme-To-PhonemeMultilingual Automatic Speech Recognition

  31. From Monolingual to Multilingual: Evaluating Mamba for ASR in South African Languages

    Jul 1, 2026Jesujoba O. Alabi, Julian Herreilers, Badr M. Abdullah +1Multilingual Automatic Speech RecognitionAutomatic Speech Recognition

  32. Disentangling Speaker and Language Effects in Cross-Lingual Speaker Verification for Iberian Languages

    Jul 1, 2026Pol Buitrago, Javier HernandoAutomatic Speaker VerificationCross-Lingual Consistency

  33. AMR: Adaptive Modality Routing for Multimodal Polyglot Speaker Identification

    Jun 28, 2026Chuxiao Zuo, Yao Zhu, Minqiang Xu +3Multilingual Automatic Speech RecognitionSpeaker

  34. Do Speech Emphasis Models Generalize across Languages and Emotions?

    Jun 26, 2026Megan Wei, Deepali Aneja, Jiaqi Su +3Multilingual Automatic Speech RecognitionEmotion Recognition

  35. SamaVaani: Auditing and Debiasing Multilingual Clinical ASR for Indian Languages

    Jun 25, 2026Subham Kumar, Prakrithi Shivaprakash, Abhishek Manoharan +7Multilingual Automatic Speech RecognitionAutomatic Speech Recognition

  36. Dziri Voicebot: An End-to-End Low-Resource Speech-to-Speech Conversational System for Algerian Dialect

    Jun 24, 2026Dihia Lanasri, Rebeh Imane Ammar Aouchiche, Abdelkarim Remmide +2Multilingual Automatic Speech RecognitionAutomatic Speech Recognition

  37. Cross-lingual Retrieval-Augmented Classification for Dysarthria Severity Assessment

    Jun 22, 2026Taeyoung Jeong, Insung Lee, Du-Seong Chang +1Dysarthric SpeechMultilingual Automatic Speech Recognition

  38. Neural Speaker Diarization via Multilingual Training: Evaluation on Low-Resource Nepali-Hindi Speech

    Jun 21, 2026Samip Neupane, Sandesh Pokhrel, Sandesh Pyakurel +1Speaker DiarizationMultilingual Automatic Speech Recognition

  39. From Speech to Text Corpora: Evaluating ASR-Based Data Acquisition for Low-Resource Fongbe and Hausa

    Jun 20, 2026Mahounan Pericles Adjovi, Victor Olufemi, Roald Eiselen +1Multilingual Automatic Speech RecognitionTranscript

  40. Adding Robust Code-Switching Capabilities to High Performance Multilingual ASR

    Jun 20, 2026Enes Yavuz Ugan, Alexander WaibelCode-SwitchingMultilingual Automatic Speech Recognition

  41. OpenWER: Improving Cross-Lingual ASR Evaluation and Enabling Token-Based Accuracy Metrics

    Jun 19, 2026Korbinian Kuhn, Gottfried ZimmermannAutomatic Speech Recognition EvaluationCharacter Error Rate

  42. Improving low-resource ASR using bilingual fine-tuning with language identification: a cross-linguistic evaluation

    Jun 16, 2026Reihaneh Amooie, Yun Hao, Wietse de Vries +3Multilingual Automatic Speech RecognitionLow-Resource Languages

  43. L-Proto: Language-Aware Episodic Prototypical Training for Multilingual Speaker Verification

    Jun 16, 2026Hyung-Seok Oh, Deok-Hyeon Cho, Seung-Bin Kim +1Automatic Speaker VerificationMultilingual Automatic Speech Recognition

  44. UR-BERT: Scaling Text Encoders for Massively Multilingual TTS Through Universal Romanization and Speech Token Prediction

    Jun 10, 2026Sangmin Lee, Eekgyun Ahn, Woongjib Choi +1Multilingual Automatic Speech RecognitionSpeech Encoder

  45. CS-YODAS: A Mined Dataset of In-the-Wild Code-Switched Speech

    Jun 9, 2026Brian Yan, Qingzheng Wang, Matthew Wiesner +9Code-SwitchingMultilingual Automatic Speech Recognition

  46. Multilingual Word-Level Forced Alignment with Self-Supervised Representations and Learned Dynamic Programming

    Jun 9, 2026Roy Weber, Meidan Zehavi, Rotem Rousso +1Motion-Language AlignmentMultilingual Automatic Speech Recognition

  47. OpenBibleTTS: Large-Scale Speech Resources and TTS Models for Low-Resource Languages

    Jun 8, 2026David Guzmán, Luel Hagos Beyene, Jesujoba Oluwadara Alabi +3Multilingual Automatic Speech RecognitionFlow-Matching Text-To-Speech

  48. Overcoming Decoder Inconsistencies in Whisper for Dravidian and Low-Resource Languages

    Jun 8, 2026Chowdam Venkata Kumar, Kumud Tripathi, Pankaj WasnikMultilingual Automatic Speech RecognitionLow-Resource Languages

  49. KIT's Submission to Cross-Lingual Voice Cloning in IWSLT 2026

    Jun 5, 2026Seymanur Akti, Alexander WaibelCross-Lingual Voice CloningMultilingual Automatic Speech Recognition

  50. Multilingual Multi-Speaker Unit Vocoders: A Systematic Analysis of Discrete Speech Representations

    Jun 4, 2026Naman Kothari, Arjun Gangwar, Adarsh Arigala +1Discrete Speech RepresentationsMultilingual Automatic Speech Recognition

  51. Multi-task Learning is Not Enough: Representational Entanglement in Dual-output Second Language Speech Recognition

    Jun 4, 2026Seung Hwan Cho, Young-Min KimMultilingual Automatic Speech RecognitionDual-Encoder Architectures

  52. Towards Truly Multilingual ASR: Generalizing Code-Switching ASR to Unseen Language Pairs

    Jun 4, 2026Gio Paik, Hyunseo Shin, Soungmin LeeMultilingual Automatic Speech RecognitionAutomatic Speech Recognition

  53. PolySpeech-100: A Large-Scale Benchmark for Speech Understanding Across 100+ Languages and Dialects

    May 31, 2026Sicheng Yang, Shulan Ruan, Shiwei Wu +4Multilingual Automatic Speech RecognitionDialects