Automatic Speech Recognition

Also known as ASR

Momentum

54 papers in the last four weeks, up 238% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 302

All topics
CardsList
  1. Context-Aware ASR for Mandarin Technical Lectures

    Jul 6, 2026Ho-Lam Chung, Yiming Chen, Hung-yi LeeASR EvaluationAutomatic Speech Recognition

  2. Listen, Think, Transcribe: Continuous Latent Test-Time Scaling for ASR

    Jul 6, 2026Ho Lam Chung, Yiming Chen, Dau-Cheng Lyu +2Test-Time ScalingAutomatic Speech Recognition

  3. S-DiverSe: Spanish Diverse Speech

    Jul 3, 2026Fernando López, Fernando Ibañez, Ana Martínez +4ASR EvaluationSpeech Processing

  4. Reinforcement Learning for Data-Efficient Code-Switched ASR

    Jul 2, 2026Ziwei Ye, Peter VickersCode-Switching Speech RecognitionAudio-Language Models

  5. NAVER LABS Europe Submission to the Instruction-following 2026 Short Track

    Jul 2, 2026Marcely Zanon Boito, Hemant Yadav, Jean-Luc Meunier +1Speech TranslationQuestion Answering

  6. H-SAGE: Holistic Speaker-Aware Guided Experts for MoE-based Multi-Talker ASR

    Jul 2, 2026Yujie Guo, Jiaming Zhou, Yuhang Jia +2Automatic Speech RecognitionExpert Routing

  7. Adapting Foundation ASR Models to Dysarthric Speech: A Case Study

    Jun 30, 2026Christian Huber, Laura Kernahan, Alexander WaibelAutomatic Speech RecognitionDysarthric Speech Recognition

  8. Tone-Conditioned Curriculum Learning for Low-Resource Bantu Speech Recognition

    Jun 30, 2026Kesego Mokgosi, Vukosi Marivate, Sitwala Mundia +3Automatic Speech RecognitionLow-Resource Speech Recognition

  9. Building an ASR Solution for Training and Assessing Children's Reading

    Jun 30, 2026Yacouba Diarra, Nouhoum Souleymane Coulibaly, Mamadou Dembele +2Automatic Speech RecognitionLow-Resource Speech Recognition

  10. What Counts as an Error? Dual-Reference Benchmarking for Atypical ASR

    Jun 30, 2026Hawau Olamide Toyin, Srinivasan Umesh, Hanan AldarmakiASR EvaluationAutomatic Speech Recognition

  11. Comparing Human and Automatic Recognition of Dutch Dysarthric Continuous Speech: A Case Study

    Jun 29, 2026Yuanyuan Zhang, Dimme de Groot, Jorge Martinez +1ASR EvaluationAutomatic Speech Recognition

  12. VIB-AVSR: Variational Information Bottleneck for Noise-Robust LLM-Based Audio-Visual Speech Recognition

    Jun 28, 2026Piyush Arora, Navlika Singh, Umberto Cappellazzo +2Automatic Speech RecognitionAudio-Visual Speech Recognition

  13. Position-Aware Target Speaker Extraction for Long-Form Multi-Party Conversations: A Diarization-Free Framework for ASR

    Jun 28, 2026Yichi Wang, Junzhe Chen, Wangjin Zhou +1Target Speaker ExtractionSpeech Processing

  14. How to Leverage Synthetic Speech for LLM-Based ASR Systems?

    Jun 27, 2026Yanis Labrak, Dairazalia Sanchez-Cortes, Sergio Burdisso +9Synthetic-to-Real Domain AdaptationSynthetic Data Augmentation

  15. Clustering Unsupervised Representations as Defense against Poisoning Attacks on Speech Commands Classification System

    Jun 27, 2026Thomas Thebaud, Sonal Joshi, Henry Li +4Backdoor AttacksAutomatic Speech Recognition

  16. Improving Large-Scale Weakly Supervised ASR by Filtering and Selection

    Jun 27, 2026Kohei Matsuura, Masato MimuraDomain AdaptationTraining Data Selection

  17. What Was That Again? Certified Robustness for Automatic Speech Recognition

    Jun 26, 2026Andrew C. Cullen, Neil G. Marchant, Jiani Xie +2ASR EvaluationNeural Network Robustness

  18. SamaVaani: Auditing and Debiasing Multilingual Clinical ASR for Indian Languages

    Jun 25, 2026Subham Kumar, Prakrithi Shivaprakash, Abhishek Manoharan +7ASR EvaluationDemographic Bias in ASR

  19. Enhancing BEST-RQ Pseudo-Label Quality through Online Refinement for Automatic Speech Recognition

    Jun 24, 2026Jingjing Xu, Zijian Yang, Mohammad Zeineldeen +3Automatic Speech RecognitionVector Quantization

  20. Phoneme-Level Mispronunciation Screening in Polish-Speaking Children with an Explainable Assistant

    Jun 23, 2026Milosz Dudek, Daria Hemmerling, Kamil Kwarciak +9Speech ProcessingAutomatic Speech Recognition

  21. Progressive Alignment Objectives for Aligner-Encoder based ASR

    Jun 23, 2026Jaeyoung Lee, Masato Mimura, Takafumi MoriyaAutomatic Speech RecognitionSequence Alignment

  22. A Fusion-Aware Two-Stage Framework for Mispronunciation Detection and Diagnosis in Low-Resource Modern Standard Arabic

    Jun 23, 2026Jing Yang, Shuqing Zhang, Yongyi Deng +5Domain AdaptationSpeech Processing

  23. From Text Metrics to Model Internals: A Study of Whisper ASR Hallucination Detection

    Jun 22, 2026Jan Jasiński, Mateusz Barański, Julitta Bartolewska +2Audio-Language Model Hallucination DetectionAutomatic Speech Recognition

  24. HALAS: A Human-Annotated Dataset of Hallucinations of Modern ASR Systems

    Jun 22, 2026Mateusz Barański, Jan Jasiński, Julitta Bartolewska +2ASR EvaluationHallucination Detection

  25. Scaling Audio Models Efficiently: Joint Optimization of Scale, Resolution, Adaptation, Precision, and Sparsity

    Jun 22, 2026Vyom Agarwal, Mokshda Gangrade, Siddharth Pal +1Model CompressionStructured Sparsity

  26. ATCCaps: A Call-Sign-Aware Speech Dataset for Air Traffic Control Recognition

    Jun 21, 2026Dongdong Li, Jianwei Song, Jianwei Wang +1ASR EvaluationAutomatic Speech Recognition

  27. From Speech to Text Corpora: Evaluating ASR-Based Data Acquisition for Low-Resource Fongbe and Hausa

    Jun 20, 2026Mahounan Pericles Adjovi, Victor Olufemi, Roald Eiselen +1Automatic Speech RecognitionLow-Resource Language Processing

  28. Adding Robust Code-Switching Capabilities to High Performance Multilingual ASR

    Jun 20, 2026Enes Yavuz Ugan, Alexander WaibelCode-Switching Speech RecognitionCode-Switching