Speech Enhancement

Momentum

22 papers in the last four weeks, up 69% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 88

All topics
CardsList
  1. AuraSE: Low-Hallucination Generative Speech Enhancement via Multimodal Flow Matching and Inference Policy Optimization

    Oct 5, 2026Yingda Shen, Yao Qian, Yuxuan Hu +7Speech Enhancement

  2. How Reliable Are Predicted MOS for Reproducing Human System-Level Preferences in Speech Enhancement?

    Sep 30, 2026Nahomi Kusunoki, Tsubasa Ochiai, Naohiro Tawara +4Mean Opinion ScoresSpeech Enhancement

  3. Improving Predicted MOS Scores, Not Perceived Quality: Multi-Predictor Test-Time Optimization of Enhanced Speech

    Sep 30, 2026Tsubasa Ochiai, Marc Delcroix, Nahomi Kusunoki +5Mean Opinion ScoresSpeech Enhancement

  4. Long-Term Memory-Guided Enhancement for Target Perception in Audio-Language Models

    Sep 29, 2026Zhenhong Zhou, Xuanyue Zhao, Youji Liu +4Large Audio Language ModelsSpeech Enhancement

  5. RemixIT-TSE: Progressive Synthetic-to-Real Adaptation for Target Speech Extraction via Target-Aware Supervision and Remixing

    Sep 28, 2026Yu Wang, Haixin Guan, Shuang Wei +1Target Speaker ExtractionSpeech Enhancement

  6. Perceptual Quality Loss or Loss of Perceptual Quality?

    Sep 28, 2026Danilo de Oliveira, Tal Peer, Maurício do V. M. da Costa +1Speech EnhancementPerceptual Quality

  7. Domain-Incremental Learning for Generative Speech Enhancement

    Sep 28, 2026Manjunath Mulimani, Annamaria Mesaros, Minje Kim +1Speech EnhancementClass-Incremental Learning

  8. Unsupervised Speech Enhancement via Drifting

    Sep 28, 2026Diego Caviedes-Nozal, Liang Xu, Rasmus Kongsgaard Olsson +1Speech EnhancementSpeaker Similarity

  9. Transformer-based Neural Beamforming for Real-Time Speech Enhancement on Smart Low-Power Hearable Devices

    Sep 27, 2026Luca Bompani, Marco Fariselli, Giovanni Oltrecolli +1Speech EnhancementBeamforming

  10. Does per-frame early exit pay? A compute-matched study of dynamic depth for on-device speech enhancement

    Sep 24, 2026Clément Laroche, Riccardo MicciniSpeech EnhancementNeural Processing Units

  11. Beyond Model Size: Redesigning LiSenNet for embedded speech enhancement

    Sep 24, 2026Clément Laroche, Rasmus Kongsgaard OlssonSpeech EnhancementNeural Processing Units

  12. Transcript-Supervised Post-Training of Generative Speech Enhancement on Real Recordings via Reinforce Adjoint Matching

    Sep 24, 2026Julius Richter, Christoph Boeddeker, Yoshiki Masuyama +4Speech EnhancementPost-Training

  13. The Vulnerability of Neural Audio Watermarks under Speech Enhancement

    Sep 24, 2026Xincong Zhong, Shengyao Wang, Lingfeng Yao +4Multi-Bit WatermarkingSpeech Enhancement

  14. CHiME-9 ECHI: A Machine Learning Challenge for Enhancing Conversations to Address Hearing Impairment

    Sep 22, 2026Robert Sutherland, Thomas Kuebert, Marko Lugger +6Speech Enhancement

  15. SE-MSB: End-to-End Unpaired Speech Enhancement using Mamba Schrödinger Bridges

    Sep 22, 2026Andreas Bagge, Andreas Nymand, Michael Riis Andersen +1Speech EnhancementDiffusion Models

  16. Challenges of Multi-Speaker Extraction for Real Conversational Speech Enhancement

    Sep 22, 2026Robert Sutherland, Stefan Goetze, Jon BarkerTarget Speaker ExtractionSpeech Enhancement

  17. SRF-SVB: Style-Consistent Singing Voice Beautifying via Rectified Flow

    Sep 22, 2026Wenhui Li, Biao Dong, Liwei Hu +2Singing Voice ConversionVocalizations

  18. Corrective Forcing: Unified Post-Training for Diffusions and Flows in Generative Speech Enhancement

    Sep 21, 2026Qing Yao, Lijian Gao, Qirong MaoSpeech EnhancementTraining-Inference Mismatch

  19. P2Flow: Phoneme-aware Progressive Flow Matching for Extreme Speech Super-Resolution

    Sep 21, 2026Ningyuan Yang, Yize Li, Pu Zhao +5Speech EnhancementReal-World Image Super-Resolution

  20. G-Mamba: Sparse Graph-Guided Mamba for Audio-Visual Speech Enhancement

    Sep 16, 2026Guo-Ruei Tseng, Hung-Shin Lee, Hsin-Min Wang +1Speech EnhancementMamba-Based Models

  21. DriftSE: Speech Enhancement with Generative Drifting

    Sep 14, 2026Liang Xu, Diego Caviedes-Nozal, W. Bastiaan Kleijn +2Speech EnhancementAcoustic Latent Space

  22. Noise Adaptive Streaming Audio-Visual Speech Token Enhancement for Robust Full-Duplex Spoken Dialogue Models

    Sep 8, 2026Bella Godiva, Yeonju Kim, Yong Man RoSpeech Enhancement

  23. Masked Autoregressive Speech Enhancement with Continuous Neural Audio Codec Representations

    Sep 3, 2026Yoto Fujita, Simon Leglaive, Laurent GirinSpeech EnhancementNeural Audio Codecs

  24. Test-time adaptation for speech enhancement with an autoregressive speech prior

    Sep 3, 2026Sofiene Kammoun, Simon Leglaive, Xavier Alameda-Pineda +1Speech EnhancementTest-Time Adaptation

  25. StrixAE: An Intelligent Agent for Audio Enhancement under Complex Distortion Coupling in Real-World Scenarios

    Sep 3, 2026Chenglin Wu, Junjie Wu, Jinhang Chen +5Speech EnhancementAudio Understanding

  26. ABSE-NET: A Lightweight Neural Model for Active Binaural Speech Enhancement in Open-Fit Hearing Aids

    Sep 1, 2026De Hu, Xue Du, Qingying Zhao +1Speech EnhancementAbsolute Noise-To-Clean Mapping

  27. U-PAST: A Phase-Aware Audio Spectrogram Transformer-U-Net for Single-Channel Speech Enhancement

    Aug 31, 2026Cao Duong Ly, Jörn AnemüllerSpeech EnhancementNeural Audio

  28. Ouroboros: Self-Referential Backdoor Attacks on Speech Enhancement via Clean Audio Triggers

    Aug 31, 2026Yunjie Zhou, Yuheng Huang, Diqun YanSpeech EnhancementInference-Time

  29. Parallel Time-Band Mixing with Learned Observation-Adding for Robust ASR Front-Ends

    Aug 31, 2026Xingyu Shen, Runze Wang, Wei-Ping Zhu +1Speech EnhancementAutomatic Speech Recognition

  30. The ISCSLP 2026 Real-World Audio-Visual Speech Enhancement Challenge

    Aug 24, 2026Kai Li, Wenze Ren, Junjie Li +11Speech EnhancementAudio-Visual Consistency

  31. HybridSB-MoE: Dual-Domain Schrödinger Bridges with Scene-Adaptive Expert Routing for Speech Enhancement

    Aug 13, 2026Zhengyi Lu, Aswini Sivakumar, Jie Hu +1Speech EnhancementSchrödinger Bridges

  32. RT-SEMamba: Real-Time Speech Enhancement Mamba via Progressive Knowledge Distillation

    Aug 12, 2026Rong Chao, Sung-Feng Huang, Moreno La Quatra +4Speech EnhancementMamba-Based Models

  33. Deep Learning Based Relative Transfer Matrix Estimation for Multiple Sources and Multiple Microphones

    Aug 12, 2026Oshan A. B. Yalegama, Wageesha N. ManamperiMicrophone ArraySpeech Enhancement

  34. DAVE: A Decoupled Audio-Visual Enhancement Framework for Real-World Speech Separation

    Aug 10, 2026Wei Zhou, Wanyi Ning, Yinshang Guo +3Speech EnhancementSpeech Separation

  35. Cloud-Boosted Low-Compute Multi-Channel Speech Enhancement

    Aug 7, 2026Xulin Fan, Juan Azcarreta, Ashutosh Pandey +5Speech EnhancementBeamforming

  36. AnyBand: Unified Multi-Bandwidth Speech Extension via Frequency-Aware In-Context Spectral Infilling

    Aug 1, 2026Junchuan Zhao, Minh Duc Vu, Bowen Zhang +1Speech EnhancementBandwidth Extension

  37. faster-enhancer.c: A Dependency-Free int8 Runtime for Streaming Speech Enhancement on Commodity CPUs

    Jul 28, 2026Gyeongmin KimSpeech EnhancementRuntime

  38. Towards Array-Invariant Speech Enhancement via Geometry-Aware Dynamic Convolution

    Jul 21, 2026Zhenglong Liu, Wangyou Zhang, Chenda Li +1Microphone ArraySpeech Enhancement

  39. CAPS: A Cascaded Reconstruction Model to Power Saving in Hearables Using Sub-Nyquist Sampling with Bandwidth Extension

    Jul 21, 2026Tarikul Islam Tamiti, Sajid Fardin Dipto, Luke Baja-Ricketts +2Speech EnhancementMicrophone Array

  40. Low-Latency Neural Models for Real-Time Music Enhancement

    Jul 14, 2026Emmanouil Karystinaios, Jonathan Greif, David Nadrchal +2Speech EnhancementSong Generation

  41. Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation

    Jul 13, 2026Paul A. Bereuter, Mark D. Plumbley, Alois SontacchiSpeech EnhancementSpeech Separation

  42. Is Model Instability just Noise to be Tolerated or a Property that can be Managed?

    Jul 11, 2026Amirali Rayegan, Lunxiao Li, Tim MenziesInstabilityEnterprise Analytics

  43. Inside the Skill Market: From Software Engineering Activities to Reusable Agent Skills

    Jul 10, 2026Jialun Cao, Xinru Yan, Songqiang Chen +3Software EngineeringAgent Skill Retrieval

  44. It Takes Few to TANGO: A Quantized Distributed Model for Binaural Speech Enhancement

    Jul 9, 2026Zahra Benslimane, Pierre Chouteau, Martyna Poreba +4Speech EnhancementDiscrete Speech Representations

  45. Physiological Noise Augmentation Improves Non-Invasive Brain-to-Speech

    Jul 6, 2026Benjamin Ballyk, Teyun Kwon, Miran Özdogan +1Speech EnhancementAuditory Attention

  46. Ranking the Impact of Contextual Specialization in Neural Speech Enhancement

    Jul 6, 2026Peter Leer, Svend Feldt, Zheng-Hua Tan +2Speech EnhancementSpeaker

  47. RT-Tango: Real-Time Distributed Binaural Speech Enhancement for Low-Power Hearing Aid Devices

    Jul 2, 2026Z. Benslimane, P. Chouteau, M. Poreba +4Speech EnhancementReal-Time Systems

  48. Improving multichannel speech enhancement through accurate room-acoustic simulations

    Jun 30, 2026Georg Götz, Alessia Milo, Steinar Guðjónsson +3Speech EnhancementAcoustic

  49. SE-AGCNet: An End-to-End Framework for Joint Speech Enhancement and Loudness Control in Meeting Scenarios

    Jun 24, 2026Jinming Zhang, Wei Rao, Xionghu Zhong +1Speech Enhancement

  50. One Model, Many Latencies: Universal Speech Enhancement for Diverse Real-Time Applications

    Jun 24, 2026Szu-Wei Fu, Rong Chao, Xuesong Yang +4Speech EnhancementReal-Time Systems

  51. Beyond U-Net: A Latent-Representation-Aligned Skip-Free Backbone for Flow-Matching Speech Enhancement

    Jun 23, 2026Wangyi Pu, Michele ScarpinitiSpeech EnhancementLatent Flow

  52. Joint Learning of Covariance Estimation and White Noise Gain for Robust MVDR Beamforming

    Jun 23, 2026Yongyi Deng, Hanchen Pei, Jianbo Ma +3BeamformingSpeech Enhancement

  53. Neuromorphic Speech Enhancement with Dual-Branch Spiking Neural Networks

    Jun 22, 2026Taiyu Meng, Wenbin Jiang, Haoyi Zhang +2Spiking Neural NetworksSpeech Enhancement

  54. Bridging Self-Supervised Learning and Speech Enhancement: A Wav2Vec2-Conditioned Framework

    Jun 21, 2026Shuubham Ojha, Carol Espy-WilsonSpeech EnhancementWav2Vec

  55. Time-Frequency Weighted Losses for Phoneme Reconstruction in DNN-Based Speech Enhancement

    Jun 19, 2026Nasser-Eddine Monir, Paul Magron, Romain SerizelSpeech EnhancementDiscrete Speech Representations

  56. Post-Training Speech Enhancement Language Models with Perceptual Rewards

    Jun 19, 2026Frédéric Berdoz, Luca A. Lanzendörfer, Antonis Asonitis +1Speech EnhancementEnhancement

  57. Latency-Configurable Streaming Speech Enhancement via Asymmetric Temporal Padding

    Jun 18, 2026Yunsik Kim, Yoonyoung ChungSpeech EnhancementState-Tracking