ASR Evaluation

ASR: Automatic Speech Recognition

Latest papers 85

All topics
CardsList
  1. Subtitle-Aligned Fine-Tuning of Whisper for Swiss German ASR: Benchmark Contamination, Convention Mismatch, and an Honest Baseline at 25.6% WER (13.8% cWER)

    May 29, 2026Felix AkeretASR EvaluationFine-Tuning

  2. Your Multimodal Speech Model Says I Have a Face for Radio

    May 28, 2026Maya K. Nachesa, Vlad Niculae, Vagrant GautamASR EvaluationDemographic Bias in ASR

  3. SCRIBE: Diagnostic Evaluation and Rich Transcription Models for Indic ASR

    May 20, 2026Kavya Manohar, Arghya Bhattacharya, Kush Juvekar +1ASR EvaluationAutomatic Speech Recognition

  4. PAREDA: A Multi-Accent Speech Dataset of Natural Language Processing Research Discussions

    May 18, 2026Sicheng Jin, Dipankar Srirag, Aditya JoshiASR EvaluationSpeech Processing

  5. Beyond Single Ground Truth: Reference Monism as Epistemic Injustice in ASR Evaluation

    May 8, 2026Anna Seo Gyeong Choi, Maria Teleki, James Caverlee +3ASR EvaluationAutomatic Speech Recognition

  6. A Comprehensive Analysis of Tokenization and Self-Supervised Learning in End-to-End Automatic Speech Recognition applied on French Language

    May 5, 2026Thibault Bañeras-Roux, Mickael Rouvier, Jane Wottawa +1ASR EvaluationAutomatic Speech Recognition

  7. A Paradigm for Interpreting Metrics and Identifying Critical Errors in Automatic Speech Recognition

    May 5, 2026Thibault Bañeras-Roux, Mickael Rouvier, Jane Wottawa +1ASR EvaluationAutomatic Speech Recognition

  8. When Audio-Language Models Fail to Leverage Multimodal Context for Dysarthric Speech Recognition

    May 4, 2026Pehuén Moure, Niclas Pokel, Bilal Bounajma +4Audio-Language Model EvaluationASR Evaluation

  9. LRS-VoxMM: A benchmark for in-the-wild audio-visual speech recognition

    Apr 30, 2026Doyeop Kwak, Jeongsoo Choi, Suyeon Lee +1ASR EvaluationAutomatic Speech Recognition

  10. HATS: An Open data set Integrating Human Perception Applied to the Evaluation of Automatic Speech Recognition Metrics

    Apr 30, 2026Thibault Bañeras Roux, Jane Wottawa, Mickael Rouvier +2ASR EvaluationHuman-in-the-Loop Evaluation

  11. Qualitative Evaluation of Language Model Rescoring in Automatic Speech Recognition

    Apr 30, 2026Thibault Bañeras-Roux, Mickaël Rouvier, Jane Wottawa +1ASR EvaluationAutomatic Speech Recognition

  12. RAS: a Reliability Oriented Metric for Automatic Speech Recognition

    Apr 27, 2026Wenbin Huang, Yuhang Qiu, Bohan Li +5ASR EvaluationSelective Prediction

  13. Evaluation of Automatic Speech Recognition Using Generative Large Language Models

    Apr 23, 2026Thibault Bañeras-Roux, Shashi Kumar, Driss Khalil +6ASR EvaluationAutomatic Speech Recognition

  14. Do LLM Decoders Listen Fairly? Benchmarking How Language Model Priors Shape Bias in Speech Recognition

    Apr 23, 2026Srishti Ginjala, Eric Fosler-Lussier, Christopher W. Myers +1ASR EvaluationDemographic Bias in ASR

  15. Voice of India: A Large-Scale Benchmark for Real-World Speech Recognition in India

    Apr 21, 2026Kaushal Bhogale, Manas Dhir, Amritansh Walecha +11ASR EvaluationAutomatic Speech Recognition

  16. Hard to Be Heard: Phoneme-Level ASR Analysis of Phonologically Complex, Low-Resource Endangered Languages

    Apr 20, 2026V. S. D. S. Mahesh Akavarapu, Michael Daniel, Gerhard JägerASR EvaluationAutomatic Speech Recognition

  17. MUSCAT: MUltilingual, SCientific ConversATion Benchmark

    Apr 17, 2026Supriti Sinhamahapatra, Thai-Binh Nguyen, Yiğit Oğuz +3Code-Switching Speech RecognitionASR Evaluation

  18. Attack-Dependent Robustness of Neural Audio Codecs for Adversarial ASR

    Mar 10, 2026Jordan Prescott, Thanathai Lertpetchpun, Shrikanth NarayananASR EvaluationNeural Audio Codecs

  19. When Audio Separation Hurts Zero-Shot ASR: Evaluating SAM-Audio with Whisper on Bengali and English Speech

    Mar 5, 2026Akif Islam, Raufun Nahar, Md. Ekramul HamidASR EvaluationAutomatic Speech Recognition