Audio Classification

Latest papers 100

All topics
CardsList
  1. A Strength-Monotonic Law for Domain Alignment in Frozen-Embedding Bioacoustic Classification

    Oct 7, 2026Yucheng Gong, Rui Zhou, Binbin Zeng +2Cross-Domain GeneralizationAudio Classification

  2. AccentCL: Robust Accent Classification with Incremental Expansion

    Oct 5, 2026Mu-Ruei Tseng, Waris Quamer, Ghady Nasrallah +1Class-Incremental LearningAudio Classification

  3. Neural Representations, Natural Connections: What Transfers From Human Speech Foundation Models to Animal Vocalizations?

    Oct 5, 2026Tomás Arias-Vergara, Christopher Hauer, Héloïse Brotier +3Audio Representation LearningSpeech Foundation Models

  4. Do Speech Representations Preserve Regional Accent Across Read and Spontaneous Speech?

    Oct 5, 2026Paula A. Perez-Toro, Tomas Arias-Vergara, Annette Schwarz +4Audio Representation LearningSelf-Supervised Speech Representation Learning

  5. LAST: Looped Audio Spectrogram Transformer

    Oct 1, 2026Haider Al-Tahan, Sean O'Brien, Anastasia Razdaibiedina +1Audio UnderstandingRecurrent Transformers

  6. Rate-Agnostic Bioacoustics: Heterogeneous Multi-Taxa Classification with Continuous Filterbanks and Fourier Neural Operators

    Sep 29, 2026Stefano Ciapponi, Francesco Ardan Dal Rı, Nicola Conci +1BioacousticsAudio Classification

  7. OpenWhistle: A Large-Scale Longitudinal Dataset and Benchmark of Bottlenose Dolphin Vocalizations

    Sep 28, 2026Faadil Mustun, Chiara Semenzin, Roberto Dessi +7Sound Event DetectionBioacoustics

  8. Uncovering shortcut learning in audio classifiers by discovering recurring concepts in temporal explanations

    Sep 27, 2026Cecilia Bolaños, Luciana Ferrer, Magdalena FuentesConcept-Based ExplanationsClassification

  9. Towards Deployable Underwater Vessel Classification

    Sep 24, 2026Abishek Soti, Thura Pyae Sone, Naqib Ibnul +4Passive Acoustic MonitoringLightweight CNNs

  10. Physiologically Informed Digital Auscultation for Pneumonia Detection in Long-term Care Residents

    Sep 23, 2026Nicholas Rasmussen, Oleg Zaslavsky, Zih-Ling Wang +5Audio ClassificationRespiratory Sound Classification

  11. Long-Tail Rebalancing for Non-Verbal Vocalization-Aware ASR: A Track 1 System for the NVVSpeech Challenge

    Sep 20, 2026Shangyue Jia, Jingru Ma, Yangzhuo Li +9Long-Tail LearningAutomatic Speech Recognition

  12. Misrecognition or Abstraction? Rethinking Outputs of Sound Event Recognition

    Sep 20, 2026Naoya Tomida, Yuki Okamoto, Keisuke ImotoSound Event DetectionAudio Classification

  13. The Unbearable Weight: Scaling Models and Methods for UAV Audio Classification

    Sep 15, 2026Andrew P. Berg, Qian Zhang, Mia Y. WangLightweight CNNsAudio Classification

  14. Sample-Conditioned Representation Selection for Audio Few-Shot Learning

    Sep 15, 2026Fengrui Liu, Ningxin Shen, Yi Li +3Few-Shot Audio ClassificationAudio Representation Learning

  15. Listening for Airway Stenosis: A Foundation Model-Based Method for Rapid and Accessible Detection

    Sep 14, 2026Jean Groeninger, Zihao Zhao, Juliana de Castilhos +2Speech Foundation ModelsAudio Classification

  16. Unlabeled Echoes: Pseudo-Labels and Genus-Aware Smoothing for Bat Call Recognition

    Sep 14, 2026Frank Fundel, Alexandra HowardPseudo-LabelingBioacoustics

  17. Investigating catastrophic forgetting in sound event classification

    Sep 12, 2026Riccardo Casciotti, Annamaria MesarosClass-Incremental LearningIncremental Learning

  18. Processing and classifying bird songs using wavelet techniques and supervised learning

    Sep 11, 2026Laura Lucia Dominguez Barrios, Fidel Aniano Causil Barrios, Alex Rodrigo dos Santos Sousa +1Wavelet MethodsBioacoustics

  19. MADS: A Multiview Acoustic Descriptor Set Beyond Standard Spectral Summaries

    Sep 1, 2026Utsab Ghosh, Roshni ChakrabortyAudio Classification

  20. A Parameter-Free Few-Shot Evaluation for Elephant Vocalisation Classification

    Aug 14, 2026Christiaan M. Geldenhuys, Thomas R. NieslerFew-Shot Audio ClassificationPrototype-Based Classification

  21. Robust Multi-Tier Infant-Centered Audio Understanding with Whisper via Structured Speaker Conditioning

    Aug 12, 2026Xulin Fan, Jialu Li, Mohammad Nur Hossain Khan +4Speech Foundation ModelsDomain Generalization

  22. DINO-A: Adapting Self-Distillation Vision Transformers to General Audio Representation Learning

    Aug 11, 2026Tomasz Radzikowski, Mateusz Modrzejewski, Przemysław RokitaAudio Representation LearningSelf-Supervised Pre-Training

  23. Frame-Level Pansori Mode Classification with Complementary Audio Representations

    Aug 6, 2026Sangheon Park, Seonguk Ju, Suin Chung +2Music Information RetrievalAudio Classification

  24. Smartphone Audio Based Distress Detection

    Aug 4, 2026Anil Sharma, Sarthak Ahuja, Mayank Gautam +1Sound Event DetectionAudio Classification

  25. Deep Learning for Real-Time Sound Order Recognition in Human-Robot Interaction

    Aug 4, 2026Rezaul Tutul, Usaid Khan, Andre Jakob +1Human-Robot InteractionAudio Classification

  26. Uncertainty-Aware Crossmodal Fusion for Classification of Animal Behavior

    Aug 3, 2026Ehsan Yaghoubi, Florian HaselbeckUncertainty-Aware Multimodal FusionBioacoustics

  27. Few-Shot Open-Set Audio Classification via Transductive Prototype Refinement and Class Logit Enhancement

    Jul 29, 2026Tianyan Deng, Yanxiong Li, Rui Gao +1Few-Shot Audio ClassificationPrototype-Based Classification

  28. Device Invariance using Domain Adaptation on Acoustic Scene Classification

    Jul 28, 2026Abhishek dileep, Shubham Sharma, Padmanabhan RajanDomain-Adversarial LearningUnsupervised Domain Adaptation

  29. PC-Mix: Partial-Component Audio Spoofing Detection under Mixed Speech and Environmental Sound Conditions

    Jul 11, 2026Zhenshan Zhang, Xueping Zhang, Linxi Li +2Audio Deepfake DetectionAudio Classification

  30. TriA Pipeline: A Large-Scale Automatic Audio Annotation Pipeline For Audio Classification In Specific Scenarios

    Jul 7, 2026Hong Lyu, Mingru Yang, Qianhua He +3Training Data CurationAudio Understanding

  31. Determinantal point process sampling for bioacoustic active learning

    Jul 7, 2026Hugo Magaldi, Gabriel DubusActive LearningAdaptive Sampling

  32. Sampling Bias Compensation for Robust Evaluation of Audio Classification Systems with Partially Labeled Evaluation Datasets

    Jul 5, 2026Javier Naranjo-Alcazar, Annamaria Mesaros, Tuomas Virtanen +1Importance SamplingDensity Ratio Estimation

  33. A Multi-Branch Hierarchy-Aware Framework for Heterogeneous Audio Classification

    Jul 2, 2026Beile Ning, Jiayi Yu, Zitong Wang +5Hierarchical ClassificationAudio Classification

  34. DRL-CLBA: A Clean Label Backdoor Attack for Speech Classification via DDPG Reinforcement Learning

    Jul 2, 2026Yueming Huang, Wenhan Yao, Fen Xiao +2Backdoor AttacksDeep Deterministic Policy Gradient

  35. Few-Shot Open-Set Audio Classification Using Attention Information-Fused Prototypes

    Jul 1, 2026Yanxiong Li, Jiaxin Tan, Qianqian Li +3Few-Shot Audio ClassificationPrototype-Based Classification

  36. ZEBRA: Zero-Shot Entropy-Regularized Prompt Learning for Base-to-Novel Generalization in Audio-Language Models

    Jun 30, 2026Asif Hanif, Mohammad YaqubZero-Shot LearningPrompt Learning

  37. Underwater Source Detection and Classification for Signal-based Surveillance: Audio Dataset Curation and Cross-Domain Evaluation

    Jun 27, 2026Quoc Thinh Vo, David K. HanTraining Data CurationAudio Classification

  38. Advancing Speaker-Based Vocal Effort Classification with WavLM and Data Augmentation in Naturalistic Non-Calibrated Speech Recordings

    Jun 25, 2026Zahra Omidi, John H. L. HansenData AugmentationAudio Classification

  39. FoleySet: A Multi-Level Human-Annotated Foley Sound Dataset

    Jun 24, 2026Sunshiyu Wang, Alexander LerchAudio Classification

  40. Soroll-IA: A Weakly Labeled Audio Dataset for Real-World Industrial Port Monitoring

    Jun 24, 2026Javier Naranjo-Alcazar, Jordi Grau-Haro, Ruben Ribes-Serrano +2Sound Event DetectionWeakly Supervised Learning

  41. Unlocking In-Context Learning in Audio-Language Models from Decentralized Medical Audio

    Jun 22, 2026Ran Piao, Tsai-Ning Wang, Martijn den Dekker +4Few-Shot Audio ClassificationMultimodal ICL

  42. Domain-incremental audio classification using domain-specific experts and prototype classifier

    Jun 22, 2026Jongyeon Park, Do-Hyeon Lim, Sang-won Park +4Generative ReplayDomain-Incremental Learning

  43. DSSCNet: A Transfer Learning Framework for Cross-Corpus Dysarthric Speech Severity Classification

    Jun 20, 2026Arnab Kumar Roy, Hemant Kumar Kathania, Paban Sapkota +2Speech ProcessingTransfer Learning

  44. CoughPhase-CLR: Designing an acoustics-informed foundation model for coughing sound classification

    Jun 19, 2026Marius Moldovan, Anton Batliner, Thomas M. Berghaus +2Contrastive LearningAudio Representation Learning

  45. Exploring Feature Extraction Technique Parameters for Acoustic Gunshot Classification

    Jun 17, 2026Sinclair Gurny, Ryan QuinnAudio Classification

  46. Beyond Artifacts: Towards Generalizable Synthetic Song Detection via Music-Intrinsic Features

    Jun 15, 2026Yan Han, Zhibin Wen, Yuan Wang +4Audio Deepfake DetectionAI-Generated Music Detection

  47. Acoustic Prompting via Stage-wise Modulation for Few-Shot Learning in Audio Language Models

    Jun 14, 2026Hyebin Cho, Jaehyuk Jang, Changick Kim +1Few-Shot Audio ClassificationAudio Representation Learning

  48. MambAdapter: Lightweight Mamba-Based Adapters for Parameter-Efficient Transfer Learning in Speech and Audio

    Jun 14, 2026Salman Hussain Ali, Umberto Cappellazzo, Mirco RavanelliMambaSpeech Processing

  49. Decoding Insect Song: A Multitask Semisupervised Orthoptera Bioacoustic Classifier

    Jun 11, 2026Olga Isupova, Danil Kuzin, Ella Browning +2Audio Representation LearningAudio Understanding

  50. Dolph2Vec: Self-Supervised Representations of Dolphin Vocalizations

    Jun 10, 2026Chiara Semenzin, Faadil Mustun, Roberto Dessi +5Audio Representation LearningAudio Understanding

  51. Lung-SRAD: Spectral-Aware Regularized Audio DASS with Dual-Axis Patch-Mix Contrastive Learning for Respiratory Sound Classification

    Jun 10, 2026Hemansh Shridhar, Miika Toikkanen, June-Woo KimContrastive LearningSpectral Regularization