Automatic Speech Recognition

Also known as ASR

Momentum

54 papers in the last four weeks, up 238% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 305

All topics
CardsList
  1. Leveraging Fine-grained Error Correction in Korean Speech Recognition for Consultation Services

    Sep 9, 2026Yonghyun Jun, Jimin Lee, Hwan Chang +3Automatic Speech RecognitionLow-Resource Language Processing

  2. BuzzASR: A Swarm of 100+ Monolingual Speech Recognition Models

    Sep 9, 2026Shivam Singh, Aditya Yadavalli, Catherine Arnett +1Speech Foundation ModelsAutomatic Speech Recognition

  3. Qwen-Audio-3.0-ASR Technical Report

    Sep 7, 2026Chuanmeng Bian, Daren Chen, Peixin Chen +42Streaming ASRAutomatic Speech Recognition

  4. Reducing Hallucinated Transcripts in Whisper via Hallucination Space Projection

    Sep 7, 2026Maryam Abbasihafshejani, Murtuza JadliwalaSpeech Foundation ModelsAutomatic Speech Recognition

  5. Choosing a PEFT Variant for Per-Patient Dysarthric ASR: A Single-Speaker Case Study on Two ASR Bases

    Sep 2, 2026Bernard Muller, László Tóth, LaVonne RobertsAutomatic Speech RecognitionParameter-Efficient Fine-Tuning

  6. Soft Posterior Speaker Injection for Multi-Talker Speech Recognition

    Sep 1, 2026Jian Zhu, Jun Sun, Jiang Yang +6Automatic Speech Recognition

  7. Stride-k Subsampling: Train-Free Audio Token Reduction for Whisper

    Aug 31, 2026Chanhee Cho, Junhyuk Choi, Bugeun KimAudio Token CompressionAutomatic Speech Recognition

  8. Linguistic Distance Segregates Latent Representations in Automatic Speech Recognition Systems

    Aug 31, 2026Ting-Hui Cheng, Line Katrine Harder Clemmensen, Sneha DasAutomatic Speech Recognition

  9. Conjoint Audio-to-Spikes Encoding and Processing for Efficient Neuromorphic Speech Recognition

    Aug 31, 2026Valentin M. Meunier, Amélie Gruel, Pierre Lewden +2Automatic Speech RecognitionSpiking Neural Networks

  10. Parallel Time-Band Mixing with Learned Observation-Adding for Robust ASR Front-Ends

    Aug 31, 2026Xingyu Shen, Runze Wang, Wei-Ping Zhu +1Automatic Speech RecognitionSpeech Enhancement

  11. Phoneme-guided TTS augmentation for ASR: A unified pipeline and multilingual evaluation

    Aug 27, 2026Zhen Wang, TianRui Wu, RongQi Han +3Synthetic Data AugmentationTTS Synthesis

  12. Development and Feasibility Evaluation of an Edge AI as Medical Device System for Breast Cancer Multidisciplinary Team Meetings

    Aug 22, 2026Aarzoo Dhiman, Farzana Haque, Iqtedar Muazzam +3Breast CancerClinical Decision Support

  13. Easper: An Accessible ASR Pipeline for Language Documentation

    Aug 12, 2026Aso Mahmudi, Ting Dang, Ekaterina Vylomova +1ASR EvaluationAutomatic Speech Recognition

  14. myMediWhisper: Construction of Burmese Medical Speech Corpus and Whisper Fine-Tuning for Clinical Dialogue ASR

    Aug 11, 2026Ye Kyaw Thu, Ye Bhone Lin, Thura Aung +6Speech ProcessingAutomatic Speech Recognition

  15. Edge Phoneme Recognition for Children's Speech through Age-Aware Training

    Aug 10, 2026Matthew Arboleda, Ryan Arboleda, Sophie Haak +6Automatic Speech RecognitionLow-Resource Speech Recognition

  16. From Speech to Interaction: Analyzing Multimodal Systems in Cocktail-Party Scenarios

    Aug 9, 2026Thai-Binh Nguyen, Zhaolin Li, Jan Niehues +1Target Speaker ExtractionAutomatic Speech Recognition

  17. Decolonizing Linguistic Policies in Automated Speech Recognition: A Framework for Cross-Culturally Competent Speech AI

    Aug 6, 2026Jay L. Cunningham, Mark Atta Mensah, Richard Martinez +2Automatic Speech RecognitionLow-Resource Speech Recognition

  18. How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs

    Aug 6, 2026Christian Huber, Alexander WaibelASR EvaluationAutomatic Speech Recognition

  19. Latent Softmax for Data-Efficient Phoneme-Based Multilingual ASR Across Tonal and Non-Tonal Languages

    Aug 2, 2026Saierdaer Yusuyin, Nanling Jiang, Hao Huang +1Automatic Speech RecognitionMultilingual ASR

  20. SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces

    Aug 1, 2026Ruidong Zhang, Jiacheng Liu, François Guimbretière +1Automatic Speech Recognition

  21. Normal-Anchored First-Order Model-Agnostic Meta-Learning based Whisper Fine-Tuning for Enhancing Fairness of Cleft Lip and Palate Speech Recognition

    Jul 31, 2026Susmita Bhattacharjee, Jagabandhu Mishra, H. S. Shekhawat +2Speech Foundation ModelsMeta-Learning

  22. AgenticASR: Refining Speech Recognition in Real-World Scenarios via an Agentic Approach

    Jul 30, 2026Zixuan Jiang, Binghao Qiang, Jiaying Chi +3ASR EvaluationStreaming ASR

  23. Voice Memory for Agentic Speech Recognition

    Jul 29, 2026Chao-Han Huck Yang, Zih-Ching Chen, Piotr Zelasko +3Memory-Augmented Language ModelsAutomatic Speech Recognition