Streaming ASR

ASR: Automatic Speech Recognition

Latest papers 25

All topics
CardsList
  1. Multi-Teacher Distillation for Cross-Domain Streaming Electrolaryngeal Speech Encoding

    Sep 16, 2026Benedikt Mayrhofer, Enrique Orozco Olivares, Franz Pernkopf +2Audio Representation LearningStreaming ASR

  2. Typhoon ASR Streaming: Steerable Low-Latency Thai Speech Recognition with Real-Time Shallow Fusion

    Sep 14, 2026Warit Sirichotedumrong, Tanawin Samutsin, Shah Faisal Wani +2Streaming ASRAutomatic Speech Recognition

  3. Pushing the Boundaries of Streaming Multi-Speaker ASR: A Systematic Study of Architectural Trade-offs

    Sep 9, 2026Taejin Park, Ivan Medennikov, Kunal Dhawan +3Streaming ASRAutomatic Speech Recognition

  4. Qwen-Audio-3.0-ASR Technical Report

    Sep 7, 2026Chuanmeng Bian, Daren Chen, Peixin Chen +42Streaming ASRAutomatic Speech Recognition

  5. AgenticASR: Refining Speech Recognition in Real-World Scenarios via an Agentic Approach

    Jul 30, 2026Zixuan Jiang, Binghao Qiang, Jiaying Chi +3ASR EvaluationStreaming ASR

  6. Listen, Do Not Copy: Internalizing Audio-Grounded Scaffold Context for Robust Omni-Model Speech Understanding

    Jul 24, 2026Pengfei Zhang, Biao Tian, Tianxin Xie +3Streaming ASRAutomatic Speech Recognition

  7. NPUsper: Eliminating Redundant Computation for Real-Time Whisper on Mobile NPUs

    Jul 1, 2026Sihyeon Lee, Hojeong Lee, Sungwon Woo +3Efficient Transformer InferenceStreaming ASR

  8. Online Predictive Coding for Dual-Mode Self-Supervised Speech Model

    Jun 19, 2026Keita Goto, Takashi Maekaku, Jin Sakuma +3Predictive CodingStreaming ASR

  9. Next-Turn: Duration-Aware Streaming Endpoint Detection via Time-to-Next-Speech-Onset Prediction

    Jun 16, 2026Tristan Tsoi, Jiajun Deng, Yingke Zhu +5Event Time PredictionStreaming ASR

  10. TRADE: Transducer-Augmented Decoder for Speech LLM

    Jun 7, 2026Yun Tang, Shanil Puri, Shinji Watanabe +1Streaming ASRSpeech Processing

  11. Hearing the Unspoken: Language Model Priors for Acoustic Adversarial Attacks

    Jun 5, 2026Jiani Xie, Andrew C. Cullen, Paul Montague +1Streaming ASRAutomatic Speech Recognition

  12. Dolphin-CN-Dialect: Where Chinese Dialects Matter

    May 9, 2026Yangyang Meng, Huihang Zhong, Guodong Lin +6Streaming ASRAutomatic Speech Recognition

  13. WhisperPipe: A Resource-Efficient Streaming Architecture for Real-Time Automatic Speech Recognition

    Apr 28, 2026Erfan Ramezani, Mohammad Mahdi Giahi, Mohammad Erfan Zarabadipour +2Streaming ASRSpeech Processing

  14. Reducing the Offline-Streaming Gap for Unified ASR Transducer with Consistency Regularization

    Apr 21, 2026Andrei Andrusenko, Vladimir Bataev, Lilit Grigoryan +3Streaming ASRAutomatic Speech Recognition

  15. NIM4-ASR: Towards Efficient, Robust, and Customizable Real-Time LLM-Based ASR

    Apr 20, 2026Yuan Xie, Jiaqi Song, Guang Qiu +9Streaming ASRAutomatic Speech Recognition

  16. Efficient Punctuation Restoration via Weighted Lookahead Scoring Method for Streaming ASR Systems

    Apr 18, 2026Sungmook Woo, Hyungu Kang, Chanwoo KimStreaming ASR

  17. Streaming Translation and Transcription Through Speech-to-Text Causal Alignment

    Date pendingRoman Koshkin, Jeon Haesung, Lianbo Liu +4Speech TranslationStreaming ASR