Speech Separation

Momentum

9 papers in the last four weeks, up 80% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 47

All topics
CardsList
  1. Restore, Separate, Restore: A Modular Framework for Music Source Restoration

    Oct 6, 2026Tobias Morocutti, Emmanouil Karystinaios, Gerhard WidmerSpeech SeparationAudio Editing

  2. SCISSOR: Score-Conditioned Instrument Source Separation for Orchestral Recordings

    Sep 27, 2026Yiheng Lu, Hao-Wen DongSpeech SeparationInstrument

  3. On a Separate Note: Robust Score-Informed Note Separation with a Two-Stream TFC-TDF U-Net and Adaptive Set Ownership

    Sep 24, 2026Benjamin Shiue-Hal Chou, Purvish Jajal, Nicholas John Eliopoulos +5Speech SeparationSeparation

  4. A Stem-Agnostic Approach to Hybrid AI Music Detection

    Sep 22, 2026Richa Namballa, François Rigaud, Romain HennequinGenerative MusicSpeech Separation

  5. MambaVoice: Lightweight Audiovisual Singing Voice Separation Via A Hybrid Mamba-Transformer Model

    Sep 22, 2026Adithi Shankar, Gopika Krishnan, Gloria Haro +2Speech SeparationHybrid Mamba-Transformer Model

  6. LiteCASS: A Lightweight End-to-End Network for Real-Time Stereo Cinematic Audio Source Separation

    Sep 20, 2026Yuanxin Guo, Qiang Ji, Mengmei Liu +3Speech SeparationReal-Time Systems

  7. CLASH: Counterfactual Auditing of Lexical and Prosodic Reliance in Spoken Sarcasm Detection

    Sep 15, 2026Qiyang Sun, Xudong Li, Yupei Li +4ProsodyHumor

  8. Real-Time Music Source Separation on a Low-Power Audio DSP

    Sep 14, 2026Jianan Li, Li Liu, Ken Malsky +1Speech SeparationNeural Audio

  9. EConv-TasNet: Efficient Conv-TasNet for Effective Speech Separation

    Sep 11, 2026Pei-Chun Chang, Chuan-Yi LiuSpeech Separation

  10. XVAE-WMT: Explainable Wavelet-Temporal Variational Autoencoder for Blind Source Separation of Heart and Lung Sounds

    Aug 31, 2026Yasaman Torabi, Shahram Shirani, James P. ReillySpeech SeparationQwen3

  11. Decoupled Latent Flow Matching for Few-Step Joint Vocal-Accompaniment Separation

    Aug 31, 2026Lishi Zuo, Youzhi Tu, Lu Yi +4Speech SeparationAcoustic Latent Space

  12. Dynamic Clustering for Cross-Segment Permutation Alignment in Long Speech Separation

    Aug 10, 2026Yuzhu Wang, Archontis Politis, Konstantinos Drossos +1Speech SeparationDiscrete Speech Representations

  13. DAVE: A Decoupled Audio-Visual Enhancement Framework for Real-World Speech Separation

    Aug 10, 2026Wei Zhou, Wanyi Ning, Yinshang Guo +3Speech EnhancementSpeech Separation

  14. From Speech to Interaction: Analyzing Multimodal Systems in Cocktail-Party Scenarios

    Aug 9, 2026Thai-Binh Nguyen, Zhaolin Li, Jan Niehues +1Speech Separation

  15. Separate-and-Detect: Unified Drum Transcription and Stem Generation via Latent Diffusion

    Aug 2, 2026Wei-Han Hsu, Chih-Cheng Chang, Bo-Yu Chen +2Multi-Instrument Music TranscriptionSpeech Separation

  16. CrowdioSet and PaRIRset: Two Datasets Towards Live Music Source Separation

    Jul 30, 2026Enric Gusó, Xavier SerraSpeech SeparationMicrophone Array

  17. Spacing Out: On the Reliability of Binaural Music Source Separation Metrics

    Jul 28, 2026Richa Namballa, Magdalena FuentesSound Source LocalizationSpeech Separation

  18. Music-Source-Separation-Training (MSST): A Unified Framework for Training and Evaluating Music Demixing Models

    Jul 25, 2026Roman Solovyev, Ilya Kiselev, Alexander Stempkovskiy +1Speech SeparationUnified Framework

  19. Teaching Speech Enhancement Models to Sing: Domain Adaptation from Speech Enhancement to Singing Voice Separation

    Jul 13, 2026Paul A. Bereuter, Mark D. Plumbley, Alois SontacchiSpeech EnhancementSpeech Separation

  20. Flow Matching-Based Speech Source Separation with Best-of-N Biometric Sampling

    Jul 7, 2026Anastasia Zorkina, Alexandr Anikin, Nikita Khmelev +5Speech SeparationSpeech Encoder

  21. Mixture-Constrained Max Pooling Improves Separation-Based Bird Species Classification

    Jul 3, 2026Yuzhu Wang, Kalle Lahtinen, Patrik Lauha +4Species IdentificationAnimal Vocalizations

  22. Open-Set Source Tracing as Compositional Factors via Structured Prototypes

    Jul 3, 2026Santiago Rubio, Antonio Almudévar, Antonio Miguel +2Speech SeparationOpen-Set Recognition

  23. Dualformer: Efficient Feature Extractor for Complex-valued Blind Communication Signal Analysis

    Jun 30, 2026Yurui Zhao, Xiang Wang, Jingreng Lei +3Feature ExtractionSpeech Separation

  24. TF-MoE: Time-Frequency Mixture-of-Experts for Efficient Speech Separation

    Jun 28, 2026Qinzhe Hu, Chenda Li, Wangyou Zhang +3Speech SeparationTime-Frequency

  25. Position-Aware Target Speaker Extraction for Long-Form Multi-Party Conversations: A Diarization-Free Framework for ASR

    Jun 28, 2026Yichi Wang, Junzhe Chen, Wangjin Zhou +1Target Speaker ExtractionSpeaker

  26. Nonlinear mixture model motivated subspace clustering

    Jun 28, 2026Ivica KoprivaSubspaceMixture Models

  27. DTT-BSR+: A Generative-Regression Cascade for Music Source Restoration

    Jun 23, 2026Youran Ni, Shihong Tan, Yuzhu Wang +1Speech SeparationSignal Reconstruction

  28. Inside the Latent Flow: Causal Deciphering of Attention Dynamics in Audio Separation Foundation Models

    Jun 8, 2026Yuxuan Chen, Haoyuan Yu, Peize HeSpeech SeparationAudio Understanding

  29. MeCo: One-Step MeanFlow-based Corrector for Multi-Channel Speech Separation

    Jun 8, 2026Dohwan Kim, Jung-Woo ChoiSpeech SeparationSampling Bias Compensation

  30. SURF: Separation via Unsupervised Remixing Flow

    Jun 3, 2026Henry Li, Robin Scheibler, Efthymios Tzinis +3Speech SeparationContrastive Flow Matching

  31. Feasibility of Time-Domain DNN-Based Speech Enhancement on Embedded FPGA for Hearing Aid

    Jun 2, 2026Feyisayo Olalere, Umut Altin, Kiki van der Heijden +1Speech EnhancementSpeech Separation

  32. Cross-Talk Speech Reduction, by Separation, for Separation

    May 19, 2026Zhong-Qiu Wang, Samuele CornellSpeech SeparationSeparation

  33. Predictive-Generative Drift Decomposition for Speech Enhancement and Separation

    May 7, 2026Julius Richter, Yoshiki Masuyama, Christoph Boeddeker +3Speech EnhancementSpeech Separation

  34. Embedding-Based Intrusive Evaluation Metrics for Musical Source Separation Using MERT Representations

    Apr 22, 2026Paul A. Bereuter, Alois SontacchiSpeech SeparationNeural Audio

  35. DialogueSidon: Recovering Full-Duplex Dialogue Tracks from In-the-Wild Dialogue Audio

    Apr 10, 2026Wataru Nakata, Yuki Saito, Kazuki Yamauchi +2Full-Duplex Speech ModelsSpeech Separation

  36. Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training

    Mar 17, 2026Houmin Sun, Zi Hu, Linxi Li +4Multi-Bit WatermarkingSpeech Separation

  37. When Audio Separation Hurts Zero-Shot ASR: Evaluating SAM-Audio with Whisper on Bengali and English Speech

    Mar 5, 2026Akif Islam, Raufun Nahar, Md. Ekramul HamidAutomatic Speech RecognitionSpeech Separation

  38. CodecSep: Prompt-Driven Universal Sound Separation on Neural Audio Codec Latents

    Sep 15, 2025Adhiraj Banerjee, Vipul AroraNeural Audio CodecsSpeech Separation

  39. Enforcing Speech Content Privacy in Environmental Sound Recordings using Segment-wise Waveform Reversal

    Jul 11, 2025Modan Tailleur, Mathieu Lagrange, Pierre Aumond +1Speech SeparationSpeaker