Audio Classification

Latest papers 101

All topics
CardsList
  1. Quality Adaptive Angular Margin Learning for Respiratory Sound Classification

    Jun 10, 2026Yoon Tae Kim, Heejoon Koo, Miika Toikkanen +1OOD GeneralizationMetric Learning

  2. Pretrained self-supervised speech models can recognize unseen consonants

    Jun 10, 2026Chihiro Taguchi, Éric Le Ferrand, Hirosi Nakagawa +4Automatic Speech RecognitionSelf-Supervised Speech Representation Learning

  3. Optimizing 2D Input Representations and Sub-phase Fusion Strategies for Differential Diagnosis of Asthma and COPD Using CNN- and GRU-Based Networks

    Jun 9, 2026Ipek Sen, Ozgur Ozdemir, Elena Battini SonmezMedical DiagnosisConvolutional Neural Networks

  4. RespiraMFM: A Multimodal Foundation Model with Contrastive Audio-Language Alignment for Respiratory Disease Identification

    Jun 8, 2026Shakhrul Iman Siam, Tiantian Feng, Jiankun Zhang +2HealthcareAudio-Language Models

  5. Few-shot Class-variable Incremental Audio Classification via Prototype Adaptation and Pseudo Class-variable Training

    Jun 8, 2026Yanxiong Li, Guoqing Chen, Qianqian Li +1Class-Incremental LearningFew-Shot Audio Classification

  6. AeroSpectra Sentinel: An Auditable LLM Prompt-Chaining Decision-Support Workflow for Acute Asthma Risk Assessment from Respiratory Sounds and Clinical Signals

    Jun 6, 2026Aueaphum AueawatthanaphisutLLM AuditingClinical Decision Support

  7. Towards Event-Robust Acoustic Scene Classification

    Jun 5, 2026Yiqiang Cai, Bohan Hu, Yu Yang +3Benchmark ConstructionAudio Classification

  8. Representation Matters in Randomized Smoothing for Audio Classification

    Jun 2, 2026Jong-Ik Park, Shreyas Chaudhari, José M. F. Moura +1Randomized SmoothingKeyword Spotting

  9. Parameter-efficient Dual-encoder Architecture with Differentiable Choquet Integral Fusion for Underwater Acoustic Classification

    Jun 1, 2026Amirmohammad Mohammadi, Joshua Peeples, Alexandra Van DineMultimodal FusionAudio Classification

  10. C2GA: A Class-Controllable Generative Augmentation Framework for Respiratory Sound Classification

    Jun 1, 2026Ziqi Ma, Mengyu Han, Anteng Cai +4Synthetic Data AugmentationAudio Classification

  11. Mitigating Stethoscope-Induced Shortcuts in Respiratory Sound Classification under Federated Domain Generalization with Causality-Inspired Interventions

    May 28, 2026Heejoon Koo, Yoon Tae Kim, Miika Toikkanen +1OOD GeneralizationShortcut Learning

  12. ChildVox: A Speech, Audio, and Large Audio-Language Model Benchmark in Understanding and Characterizing Sound across Childhood

    May 28, 2026Tiantian Feng, Anfeng Xu, Xuan Shi +10Audio-Language Model EvaluationSpeech Quality Assessment

  13. Evaluating the Temporal Detection Capability of Integrated Gradients Applied on Sound Classifier

    May 22, 2026Martynas Dumpis, Tuomas VirtanenGradient-Based AttributionIntegrated Gradients

  14. CoarseSoundNet: Building a reliable model for ecological soundscape analysis

    May 20, 2026Alexander Gebhard, Andreas Triantafyllopoulos, Dominik Arend +4Sound Event DetectionPassive Acoustic Monitoring

  15. Robust Audio Tagging under Class-wise Supervision Unreliability

    May 17, 2026Yuanbo Hou, Zhaoyi Liu, Tong Ye +4Noisy-Label LearningWeakly Supervised Learning

  16. Masked Autoencoders with Limited Data: Does It Work? A Fine-Grained Bioacoustics Case Study

    May 13, 2026Wuao Liu, Mustafa Chasmai, Subhransu Maji +1Masked AutoencodersBioacoustics

  17. SpurAudio: A Benchmark for Studying Shortcut Learning in Few-Shot Audio Classification

    May 13, 2026Giries Abu Ayoub, Morad Tukan, Loay MualemFew-Shot Audio ClassificationAudio Understanding

  18. Hearing the Ocean: Bio-inspired Gammatone-CNN framework for Robust Underwater Acoustic Target Classification

    May 6, 2026Rajeshwar Tripathi, Sandeep Kumar, Monika Aggarwal +1Convolutional Neural NetworksAudio Classification

  19. Ecologically-Constrained Task Arithmetic for Multi-Taxa Bioacoustic Classifiers Without Shared Data

    May 5, 2026Ragib Amin Nihal, Benjamin Yen, Runwu Shi +2Task ArithmeticBioacoustics

  20. Smart Passive Acoustic Monitoring: Embedding a Classifier on AudioMoth Microcontroller

    May 5, 2026Louis Lerbourg, Paul Peyret, Juliette Linossier +1Efficient Neural Network InferenceSound Event Detection

  21. Private Speech Classification without Collapse: Stabilized DP Training and Offline Distillation

    May 4, 2026Yadi Wen, Tianxin Li, Enji Liang +2Differentially Private Stochastic Gradient DescentLearning Using Privileged Information

  22. MMAudio-LABEL: Audio Event Labeling via Audio Generation for Silent Video

    May 1, 2026Kazuya Tateishi, Akira Takahashi, Atsuo Hiroe +3Audio-Video GenerationSound Event Detection

  23. From Birdsong to Rumbles: Classifying Elephant Calls with Out-of-Species Embeddings

    Apr 30, 2026Christiaan M. Geldenhuys, Thomas R. NieslerAudio Representation LearningAudio Understanding

  24. Meta-Ensemble Learning with Diverse Data Splits for Improved Respiratory Sound Classification

    Apr 27, 2026June-Woo Kim, Miika Toikkanen, Heejoon Koo +3Ensemble LearningAudio Classification