Automatic Speech Recognition

Also known as ASR

Momentum

54 papers in the last four weeks, up 238% on the four weeks before. 0.5% of all new papers.

Jul 13Week of Sep 28

Latest papers 302

All topics
CardsList
  1. Breaking Adversarial Transferability in Fine-Tuned Speech Recognition

    Oct 6, 2026Mojtaba Nafez, Aref Mousavi, Mohammad Ebrahim Mahdavi +3Adversarial TransferabilityAutomatic Speech Recognition

  2. Phoneme-Guided Initialization for LLM-based Speech Recognition

    Oct 6, 2026Ryo Magoshi, Shinsuke Sakai, Tatsuya KawaharaAutomatic Speech RecognitionSpeech Language Models

  3. DirectSpeech2LLM: A Simple End-to-End Framework to Mitigate Prompt Overfitting in Speech-LLMs

    Oct 6, 2026Hemant Yadav, Sunayana Sitaram, Roger Zimmermann +1Automatic Speech RecognitionSpeech Language Models

  4. Automatic Speech Recognition for Low-Resource Sinhala: A Critical Review of Methods, Challenges, and Future Directions

    Oct 5, 2026Chanuka Dinuwan, Sanath Jayasena, Buddhika KarunarathneASR EvaluationAutomatic Speech Recognition

  5. AraYoungVoices: A Diverse L1/L2 Corpus of Arabic Child and Adolescent Speech

    Oct 4, 2026Shammur Absar Chowdhury, Zien Sheikh Ali, Houssam Eddine-Othman Lachemat +1Automatic Speech Recognition

  6. Toward Elastic Speech Inference: Training-Free Wake-Word Detection from Pretrained ASR

    Oct 1, 2026Hwayeon Kim, Youngwon Choi, Hyeonyu KimModel CompressionSpeech Processing

  7. FFASR: Benchmarking Far-Field Automatic Speech Recognition using High-Fidelity Simulated RIRs

    Sep 30, 2026Shivam Saini, Eric Bezzam, Georg Götz +5ASR EvaluationAutomatic Speech Recognition

  8. Talk2Agent: Benchmarking Voice Interfaces for Text Agents

    Sep 30, 2026Terumi Chiba, Guangzhi Sun, Zheqi Yuan +1ASR EvaluationVoice Agent Evaluation

  9. AS2^2D: Accelerating On-Demand Audio Understanding on Mobile Devices

    Sep 29, 2026Yunzhe Li, Kyoungjun Park, Hongzi Zhu +1On-Device Language Model InferenceLanguage Model Decoding

  10. Benchmarking Automatic Speech Recognition Tools for Iberian Languages

    Sep 29, 2026Fernando López, Pablo Gómez, David Solans +2ASR EvaluationAutomatic Speech Recognition

  11. BaLEEN: Biasing with Latent Encoded Entities for Context-Aware ASR

    Sep 29, 2026Chihiro Taguchi, Yotaro Kubo, Rujikorn CharakornDomain Adaptation for ASRAutomatic Speech Recognition

  12. Almieyar: A Culturally Grounded Benchmark for Multi-Dialect Arabic Speech Recognition

    Sep 28, 2026Omid Ghahroodi, Anas Madkoor, Dima Faris Al Saudi +37ASR EvaluationArabic NLP

  13. Latency and accuracy tradeoffs in Spiking Neural Networks

    Sep 28, 2026Zhanglu Yan, Zixuan Zhu, Kaiwen Tang +3Efficient Neural Network InferenceAutomatic Speech Recognition

  14. CARDAMOM: A Micro-Dialectal Arabic Speech Dataset for ASR

    Sep 28, 2026Bashar Talafha, Samar M. Magdy, Aisha Alansari +36ASR EvaluationArabic NLP

  15. Evaluating Machine Unlearning in ASR

    Sep 28, 2026Diogo Dinis, Francisco Teixeira, Bhiksha Raj +2Automatic Speech RecognitionMachine Unlearning

  16. In-Context Adaptation of Encoder-Decoder Models in Speech Recognition

    Sep 27, 2026Yen Meng, Sharon Goldwater, Hao TangDomain Adaptation for ASRAutomatic Speech Recognition

  17. Unified Target-Speaker ASR with Text and Enrollment Speech Cues

    Sep 27, 2026Yuxiang Mei, Yuchen Yan, Dongxing Xu +2Target Speaker ExtractionAutomatic Speech Recognition

  18. Audio LLMs Know When They Can't Hear You

    Sep 24, 2026Amirhosein Javadi, Richa Dixit, Mehrdad Farajtabar +3Audio-Language Model EvaluationLanguage Model Self-Assessment

  19. Pretrained ASR Pseudo-labeling for Noisy Police Audio

    Sep 24, 2026Kaavya Chaparala, Su Huang, Stephen L. Morgan +2Domain Adaptation for ASRAutomatic Speech Recognition

  20. A Training Criterion with Token-Level Tolerance to Transcription Ambiguity for Automatic Speech Recognition

    Sep 24, 2026Saurabh Kumar, Diptiman Mohanta, Prasanta Kumar GhoshAutomatic Speech Recognition

  21. STAM-ASR: Speaker-Temporal Anchoring with Memory for Multi-Speaker ASR

    Sep 24, 2026Victor Tolulope Olufemi, Syeda Faiza Ahmed Sara, Shammur Absar ChowdhuryAudio-Language ModelsAutomatic Speech Recognition

  22. Benchmarking and Domain Adaptation of Automatic Speech Recognition (ASR) for Adolescent Health Communication in Ghanaian Languages

    Sep 24, 2026Stephen E. Moore, Akwasi Asare, Mich-Seth Owusu +3ASR EvaluationDomain Adaptation for ASR

  23. TS-OPD: Reconciling ASR and QA in Speech Language Models via Task-Specific On-Policy Distillation

    Sep 24, 2026Yujie Guo, Hongjie Chen, Jian Kang +3Automatic Speech RecognitionOn-Policy Distillation

  24. agentic-ger: terminology recovery in long-form speech using global context

    Sep 24, 2026Yanqiao Zhu, Wupeng Wang, Zhifu Gao +2Automatic Speech Recognition

  25. Learning New Words from Unlabeled Test Data in Automatic Speech Recognition

    Sep 24, 2026Mengqi Wang, Mark A. Hasegawa-Johnson, Haolong Zheng +1Test-Time AdaptationDomain Adaptation for ASR