Audio Source Separation

Momentum

11 papers in the last four weeks, up 120% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 38

All topics
CardsList
  1. Restore, Separate, Restore: A Modular Framework for Music Source Restoration

    Oct 6, 2026Tobias Morocutti, Emmanouil Karystinaios, Gerhard WidmerAudio Source Separation

  2. Trigger Sound Suppression for Misophonia

    Sep 28, 2026Vaishnavi Vidyasagar, Jasmine Zhang, Mahima Uliyar +4Mental HealthAudio Source Separation

  3. SCISSOR: Score-Conditioned Instrument Source Separation for Orchestral Recordings

    Sep 27, 2026Yiheng Lu, Hao-Wen DongAudio Source Separation

  4. Spot, Separate, and Enhance: Fully Generative Approach for Audio Mixing

    Sep 24, 2026Ilpo Viertola, Giulio Cengarle, Gouthaman KV +2Audio EditingAudio Source Separation

  5. On a Separate Note: Robust Score-Informed Note Separation with a Two-Stream TFC-TDF U-Net and Adaptive Set Ownership

    Sep 24, 2026Benjamin Shiue-Hal Chou, Purvish Jajal, Nicholas John Eliopoulos +5Audio Source Separation

  6. MambaVoice: Lightweight Audiovisual Singing Voice Separation Via A Hybrid Mamba-Transformer Model

    Sep 22, 2026Adithi Shankar, Gopika Krishnan, Gloria Haro +2Audio Source Separation

  7. LiteCASS: A Lightweight End-to-End Network for Real-Time Stereo Cinematic Audio Source Separation

    Sep 20, 2026Yuanxin Guo, Qiang Ji, Mengmei Liu +3Spatial AudioAudio Source Separation

  8. Real-Time Music Source Separation on a Low-Power Audio DSP

    Sep 14, 2026Jianan Li, Li Liu, Ken Malsky +1Efficient Neural Network InferenceMusic Information Retrieval

  9. Neural Multichannel Distant Speaker Diarization with Heavy-tailed Source Separation Model

    Sep 14, 2026Sicheng Mao, Baihan Li, Mathieu Fontaine +2Audio Source SeparationSpeaker Diarization

  10. Open-Set Ego-Noise Separation for Legged-Robot Audition via Annotation-Free Adaptation and Pretrained-Model Transfer

    Sep 7, 2026Koki Shoda, Jun Younes Louhi Kasahara, Aoba Koyanagi +2Legged RoboticsUnsupervised Domain Adaptation

  11. XVAE-WMT: Explainable Wavelet-Temporal Variational Autoencoder for Blind Source Separation of Heart and Lung Sounds

    Aug 31, 2026Yasaman Torabi, Shahram Shirani, James P. ReillyVariational AutoencodersAudio Source Separation

  12. Decoupled Latent Flow Matching for Few-Step Joint Vocal-Accompaniment Separation

    Aug 31, 2026Lishi Zuo, Youzhi Tu, Lu Yi +4Flow MatchingFlow-Based Generative Modeling

  13. Dynamic Clustering for Cross-Segment Permutation Alignment in Long Speech Separation

    Aug 10, 2026Yuzhu Wang, Archontis Politis, Konstantinos Drossos +1Audio Source SeparationSpeech Separation

  14. DAVE: A Decoupled Audio-Visual Enhancement Framework for Real-World Speech Separation

    Aug 10, 2026Wei Zhou, Wanyi Ning, Yinshang Guo +3Speech EnhancementNoise Robustness

  15. SAGE: Switch-Aware EEG-Guided Soft Gating for Target Speaker Extraction with In-Trial Switching

    Aug 3, 2026Xuefei Wang, Ximin Chen, Yuting Ding +2Target Speaker ExtractionAudio Source Separation

  16. Separate-and-Detect: Unified Drum Transcription and Stem Generation via Latent Diffusion

    Aug 2, 2026Wei-Han Hsu, Chih-Cheng Chang, Bo-Yu Chen +2Latent Diffusion ModelsAutomatic Music Transcription

  17. CrowdioSet and PaRIRset: Two Datasets Towards Live Music Source Separation

    Jul 30, 2026Enric Gusó, Xavier SerraData AugmentationAudio Source Separation

  18. Music-Source-Separation-Training (MSST): A Unified Framework for Training and Evaluating Music Demixing Models

    Jul 25, 2026Roman Solovyev, Ilya Kiselev, Alexander Stempkovskiy +1Audio Source SeparationTest-Time Augmentation

  19. PS4: Proxy-Supervised Joint Training for Real Target Speaker Extraction

    Jul 9, 2026Wanyi Ning, Wei Zhou, Yingpeng Li +3Target Speaker ExtractionSpeech Processing

  20. Flow Matching-Based Speech Source Separation with Best-of-N Biometric Sampling

    Jul 7, 2026Anastasia Zorkina, Alexandr Anikin, Nikita Khmelev +5Flow MatchingSpeech Processing

  21. Mixture-Constrained Max Pooling Improves Separation-Based Bird Species Classification

    Jul 3, 2026Yuzhu Wang, Kalle Lahtinen, Patrik Lauha +4Multi-Label ClassificationAudio Source Separation

  22. TF-MoE: Time-Frequency Mixture-of-Experts for Efficient Speech Separation

    Jun 28, 2026Qinzhe Hu, Chenda Li, Wangyou Zhang +3Sparse Mixture-of-ExpertsSpeech Processing

  23. Position-Aware Target Speaker Extraction for Long-Form Multi-Party Conversations: A Diarization-Free Framework for ASR

    Jun 28, 2026Yichi Wang, Junzhe Chen, Wangjin Zhou +1Target Speaker ExtractionSpeech Processing

  24. DTT-BSR+: A Generative-Regression Cascade for Music Source Restoration

    Jun 23, 2026Youran Ni, Shihong Tan, Yuzhu Wang +1Audio Source Separation

  25. Inside the Latent Flow: Causal Deciphering of Attention Dynamics in Audio Separation Foundation Models

    Jun 8, 2026Yuxuan Chen, Haoyuan Yu, Peize HeCross-AttentionAudio Diffusion Models

  26. MeCo: One-Step MeanFlow-based Corrector for Multi-Channel Speech Separation

    Jun 8, 2026Dohwan Kim, Jung-Woo ChoiFlow MatchingMeanFlow

  27. SURF: Separation via Unsupervised Remixing Flow

    Jun 3, 2026Henry Li, Robin Scheibler, Efthymios Tzinis +3Unsupervised LearningFlow Matching

  28. IsoNet: Spatially-aware audio-visual target speech extraction in complex acoustic environments

    May 14, 2026Dinanath Padhya, Sajen Maharjan, Binita Adhikari +1Audio-Visual UnderstandingTarget Speaker Extraction

  29. Embedding-Based Intrusive Evaluation Metrics for Musical Source Separation Using MERT Representations

    Apr 22, 2026Paul A. Bereuter, Alois SontacchiMusic Information RetrievalAutomated Evaluation

  30. DialogueSidon: Recovering Full-Duplex Dialogue Tracks from In-the-Wild Dialogue Audio

    Apr 10, 2026Wataru Nakata, Yuki Saito, Kazuki Yamauchi +2Audio Diffusion ModelsSpeech Processing

  31. Making Separation-First Multi-Stream Audio Watermarking Feasible via Joint Training

    Mar 17, 2026Houmin Sun, Zi Hu, Linxi Li +4Audio WatermarkingRobust Watermarking

  32. Focus Then Listen: An Empirical Study of Plug-and-Play Audio Enhancer for Noise-Robust Large Audio Language Models

    Mar 5, 2026Han Yin, Yang Xiao, Younghoo Kwon +2Audio UnderstandingAudio-Language Models

  33. When Audio Separation Hurts Zero-Shot ASR: Evaluating SAM-Audio with Whisper on Bengali and English Speech

    Mar 5, 2026Akif Islam, Raufun Nahar, Md. Ekramul HamidASR EvaluationAutomatic Speech Recognition

  34. CodecSep: Prompt-Driven Universal Sound Separation on Neural Audio Codec Latents

    Sep 15, 2025Adhiraj Banerjee, Vipul AroraAudio Source Separation