Spatial Audio

Momentum

15 papers in the last four weeks, up 275% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 54

All topics
CardsList
  1. Learning-based Physics-Constrained Neural Kernel for Sound Field Estimation With Source-Position-Dependent Directional Weighting

    Jul 7, 2026Mattia Marella, Shoichi KoyamaKernel RegressionImplicit Neural Representations

  2. SelectTSL: Prompt-Guided Selective Target Sound Localization in Complex Scenarios

    Jul 2, 2026Ziyang Jiang, Yu Chen, Zexu Pan +5Direction-of-Arrival EstimationSpatial Audio

  3. Speaker head orientation estimation with a single microphone array using phase spectrogram features

    Jul 2, 2026Balint Turi, Archontis Politis, Parthasaarathy Sudarsanam +1Convolutional RNNsSpatial Audio

  4. Position-Aware Target Speaker Extraction for Long-Form Multi-Party Conversations: A Diarization-Free Framework for ASR

    Jun 28, 2026Yichi Wang, Junzhe Chen, Wangjin Zhou +1Target Speaker ExtractionSpeech Processing

  5. From General-Purpose Audio Tagging to Spatially Grounded Sound Event Localization and Detection

    Jun 26, 2026Stefano Giacomelli, Stefano Damiano, Claudia Rinaldi +2Audio Representation LearningDirection-of-Arrival Estimation

  6. Statistical validation and full-sphere extension of a Bayesian model for human static sound localisation

    Jun 23, 2026Roberto Barumerli, Fabian Brinkmann, Emanuele Zanoni +3Bayesian InferenceSpatial Audio

  7. Evaluation of Headrest-Integrated Loudspeakers for Enhanced Spatial Audio Immersion in Automotive Cabins

    Jun 23, 2026Martin Wolters, Jacobo Giralt, Harald Mundt +1Spatial Audio

  8. Generalised Transcoding Framework for Arbitrary Spatial Audio Capture and Playback Formats

    Jun 16, 2026Archontis Politis, Janani Fernandez, Leo McCormackSpatial Audio

  9. Spectro-Temporal Interference Confounds Phase Encoding in Spatial Audio Foundation Models

    Jun 12, 2026Yuxuan Chen, Haoyuan Yu, Peize HeAudio Representation LearningDirection-of-Arrival Estimation

  10. Spatio-Temporal Audio Language Modeling for Dynamic Sound Sources

    Jun 12, 2026Oh Hyun-Bin, Kazuki Shimada, Yuhta Takida +6Audio-Language Model EvaluationAudio Representation Learning

  11. Sensitivity Analysis of Generative Spatial Audio Metrics: A Study on Responsiveness, Smoothness, and Symmetry

    Jun 10, 2026Purnima Kamath, Adrian S. Roman, Koichi Saito +2Automated EvaluationSpatial Audio

  12. BiEAR: A Human Auditory-Inspired Adaptive Binaural Front-end for Multi-Speaker Localisation and Distance Estimation

    Jun 5, 2026Hanyu Meng, Eliathamby Ambikairajah, Vidhyasaharan Sethu +2Adaptive InferenceDirection-of-Arrival Estimation

  13. Probing Spatial Structure in Pretrained Audio Representations

    Jun 4, 2026Chuyang Chen, Sivan Ding, Adrian S. Roman +1Audio Representation LearningRepresentation Probing

  14. SHB-AE: Spherical harmonic beamforming based Ambisonics encoding and upscaling method for smartphone microphone array

    Jun 3, 2026Yuhuan You, Yufan Qian, Tianshu Qu +2Spherical HarmonicsSpatial Audio

  15. Flow-HOA: Generative Joint Optimization for Ambisonics Encoding via Flow Matching

    Jun 3, 2026Yuhuan You, Yufan Qian, Tianshu Qu +2Spatial Audio

  16. Audio Spotforming via Post-Filtering Using Cross-Array Non-target Estimates

    Jun 2, 2026Yuto Ishikawa, Li Li, Shogo Seki +1Target Speaker ExtractionSpeech Enhancement

  17. EigeNet: Geometry-Informed Multi-Modal Learning for Few-shot Novel View RIR Prediction

    May 27, 2026Chong Jing, Zitong Lan, Junan Zhang +1Multi-View LearningFew-Shot Learning

  18. IsoNet: Spatially-aware audio-visual target speech extraction in complex acoustic environments

    May 14, 2026Dinanath Padhya, Sajen Maharjan, Binita Adhikari +1Audio-Visual UnderstandingTarget Speaker Extraction

  19. Autoregressive Guidance of Deep Spatially Selective Filters using Bayesian Tracking for Efficient Extraction of Moving Speakers

    Mar 24, 2026Jakob Kienegger, Timo GerkmannBayesian FilteringDirection-of-Arrival Estimation

  20. DiffAU: Diffusion-Based Ambisonics Upscaling

    Sep 30, 2025Amit Milstein, Nir Shlezinger, Boaz RafaelyAudio Diffusion ModelsSpatial Audio