Automatic Speech Recognition

Also known as ASR

Momentum

54 papers in the last four weeks, up 238% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 302

All topics
CardsList
  1. Qwen-Audio-3.0-ASR Technical Report

    Sep 7, 2026Chuanmeng Bian, Daren Chen, Peixin Chen +42Streaming ASRAutomatic Speech Recognition

  2. Reducing Hallucinated Transcripts in Whisper via Hallucination Space Projection

    Sep 7, 2026Maryam Abbasihafshejani, Murtuza JadliwalaSpeech Foundation ModelsAutomatic Speech Recognition

  3. Choosing a PEFT Variant for Per-Patient Dysarthric ASR: A Single-Speaker Case Study on Two ASR Bases

    Sep 2, 2026Bernard Muller, László Tóth, LaVonne RobertsAutomatic Speech RecognitionParameter-Efficient Fine-Tuning

  4. Soft Posterior Speaker Injection for Multi-Talker Speech Recognition

    Sep 1, 2026Jian Zhu, Jun Sun, Jiang Yang +6Automatic Speech Recognition

  5. Stride-k Subsampling: Train-Free Audio Token Reduction for Whisper

    Aug 31, 2026Chanhee Cho, Junhyuk Choi, Bugeun KimAudio Token CompressionAutomatic Speech Recognition

  6. Linguistic Distance Segregates Latent Representations in Automatic Speech Recognition Systems

    Aug 31, 2026Ting-Hui Cheng, Line Katrine Harder Clemmensen, Sneha DasAutomatic Speech Recognition

  7. Conjoint Audio-to-Spikes Encoding and Processing for Efficient Neuromorphic Speech Recognition

    Aug 31, 2026Valentin M. Meunier, Amélie Gruel, Pierre Lewden +2Automatic Speech RecognitionSpiking Neural Networks

  8. Parallel Time-Band Mixing with Learned Observation-Adding for Robust ASR Front-Ends

    Aug 31, 2026Xingyu Shen, Runze Wang, Wei-Ping Zhu +1Automatic Speech RecognitionSpeech Enhancement

  9. Phoneme-guided TTS augmentation for ASR: A unified pipeline and multilingual evaluation

    Aug 27, 2026Zhen Wang, TianRui Wu, RongQi Han +3Synthetic Data AugmentationTTS Synthesis

  10. Development and Feasibility Evaluation of an Edge AI as Medical Device System for Breast Cancer Multidisciplinary Team Meetings

    Aug 22, 2026Aarzoo Dhiman, Farzana Haque, Iqtedar Muazzam +3Breast CancerClinical Decision Support

  11. Easper: An Accessible ASR Pipeline for Language Documentation

    Aug 12, 2026Aso Mahmudi, Ting Dang, Ekaterina Vylomova +1ASR EvaluationAutomatic Speech Recognition

  12. myMediWhisper: Construction of Burmese Medical Speech Corpus and Whisper Fine-Tuning for Clinical Dialogue ASR

    Aug 11, 2026Ye Kyaw Thu, Ye Bhone Lin, Thura Aung +6Speech ProcessingAutomatic Speech Recognition

  13. Edge Phoneme Recognition for Children's Speech through Age-Aware Training

    Aug 10, 2026Matthew Arboleda, Ryan Arboleda, Sophie Haak +6Automatic Speech RecognitionLow-Resource Speech Recognition

  14. From Speech to Interaction: Analyzing Multimodal Systems in Cocktail-Party Scenarios

    Aug 9, 2026Thai-Binh Nguyen, Zhaolin Li, Jan Niehues +1Target Speaker ExtractionAutomatic Speech Recognition

  15. Decolonizing Linguistic Policies in Automated Speech Recognition: A Framework for Cross-Culturally Competent Speech AI

    Aug 6, 2026Jay L. Cunningham, Mark Atta Mensah, Richard Martinez +2Automatic Speech RecognitionLow-Resource Speech Recognition

  16. How to Recognize New Words: A Comparison Between Context Biasing Methods and Speech LLMs

    Aug 6, 2026Christian Huber, Alexander WaibelASR EvaluationAutomatic Speech Recognition

  17. Latent Softmax for Data-Efficient Phoneme-Based Multilingual ASR Across Tonal and Non-Tonal Languages

    Aug 2, 2026Saierdaer Yusuyin, Nanling Jiang, Hao Huang +1Automatic Speech RecognitionMultilingual ASR

  18. SoniSpeech: A Large-Scale Open-Vocabulary Tri-Modal Dataset for Wearable Silent Speech Interfaces

    Aug 1, 2026Ruidong Zhang, Jiacheng Liu, François Guimbretière +1Automatic Speech Recognition

  19. Normal-Anchored First-Order Model-Agnostic Meta-Learning based Whisper Fine-Tuning for Enhancing Fairness of Cleft Lip and Palate Speech Recognition

    Jul 31, 2026Susmita Bhattacharjee, Jagabandhu Mishra, H. S. Shekhawat +2Speech Foundation ModelsMeta-Learning

  20. AgenticASR: Refining Speech Recognition in Real-World Scenarios via an Agentic Approach

    Jul 30, 2026Zixuan Jiang, Binghao Qiang, Jiaying Chi +3ASR EvaluationStreaming ASR

  21. Voice Memory for Agentic Speech Recognition

    Jul 29, 2026Chao-Han Huck Yang, Zih-Ching Chen, Piotr Zelasko +3Memory-Augmented Language ModelsAutomatic Speech Recognition

  22. SpeechLLM Meets Federated Learning for End-to-End ASR: English and Italian Case Studies

    Jul 28, 2026Mohamed Nabih Ali, Daniele Falavigna, Alessio BruttiAutomatic Speech RecognitionSpeech Language Models

  23. Enhancing Law-Enforcement Audio Transcription: A LoRA-Based Adaptation of Whisper for BWC Footage

    Jul 27, 2026Vivek Senthil, Ernest FokouéSpeech Foundation ModelsAudio Understanding

  24. Towards Operational Conversational Intelligence: A Speech Intelligence Framework

    Jul 27, 2026C. Vishnoi, S. Khurana, A. Timmapur +2Automatic Speech RecognitionSpeaker Diarization