Self-Supervised Speech Models

Latest papers 42

All topics
CardsList
  1. Spooftral: Can Voxtral Audio-Language Model Detect Speech Spoofing?

    Sep 23, 2026Avishai Weizman, Yehuda Ben-Shimol, Itshak LapidotSpoofingSelf-Supervised Speech Models

  2. End-to-end Jordanian dialect speech-to-text self-supervised learning framework

    Sep 21, 2026Ali A. Safieh, Ibrahim Abu Alhaol, Rawan GhnematSelf-Supervised Speech ModelsArabic Natural Language Processing

  3. Language Orthogonalization for Zero-Shot Cross-Lingual Audio Deepfake Detection

    Sep 15, 2026Minu Kim, Ji Sub Um, Hoirin KimSelf-Supervised Speech ModelsMultilingual Automatic Speech Recognition

  4. Do speech foundation models really learn words?

    Sep 9, 2026Robin Huo, Ewan DunbarSelf-Supervised Speech ModelsWav2Vec

  5. Disentangled Global-Local Feature Learning with E-Branchformer for Audio Deepfake Detection

    Sep 8, 2026Phuong Tuan Dat, Ho Bao Thu, Nguyen Tran Trung +2Audio Deepfake DetectionSelf-Supervised Speech Models

  6. Cluster Assignments in Soft Targets Shape Speech Representations: Evidence from S-JEPA

    Aug 19, 2026Wenxuan He, Yunpeng Li, Zewei Li +4Self-Supervised Speech ModelsDiscrete Speech Representations

  7. ReLMCodec: Designing Predictable Speech Tokens from Pre-Quantization Phoneme Structure

    Aug 8, 2026Zixiang Wan, Xusheng Yang, Zheng Wang +1Neural Speech CodecsSelf-Supervised Speech Models

  8. DialectS2S: End-to-End Speech Dialogue Modeling for Low-Resource Chinese Dialects

    Aug 8, 2026Yi Shu, Tianyu Peng, Yingzhuo Deng +5DialectsSelf-Supervised Speech Models

  9. Spectral Aliasing Pretext: A novel task for Self-Supervised fault diagnosis in rotating machinery

    Aug 6, 2026Victor Gialis, Maxime Metz, David Esteve +1Fault DiagnosisSelf-Supervised Learning

  10. Dissecting Sensitivity to Training Language in Self-Supervised Speech Learning Using Neural Audio Codec Tokens

    Jul 28, 2026Daigo Takizawa, Tomohiko Nakamura, Samuele Cornell +3Self-Supervised Speech ModelsNeural Audio Codecs

  11. Rethinking Speech Foundation Model Fine-tuning: Better SFT or Better Match?

    Jul 15, 2026Wangjin Zhou, Yizhou Zhang, Yichi Wang +1Self-Supervised Speech ModelsSupervised Finetuning

  12. Evidence Subspace Projection: Measuring How Much Evidence Explains Deepfake Detection in Self-Supervised Speech Models

    Jul 13, 2026Yixuan Xiao, Cheng-Wei Lin, Xin Wang +5Audio Deepfake DetectionSelf-Supervised Speech Models

  13. Phone Segmentation and Recognition through Phonological Activation Mapping

    Jul 10, 2026Shikhar Bharadwaj, Kwanghee Choi, Stephen McIntosh +8Self-Supervised Speech ModelsGrapheme-To-Phoneme

  14. InsideSSL: Understanding Self-Supervised Speech Representations using a Model-Centric Perspective

    Jul 7, 2026Samir Sadok, Xavier Alameda-PinedaSelf-Supervised Speech ModelsWav2Vec

  15. TokAN: Accent Normalization Using Self-Supervised Speech Tokens

    Jul 4, 2026Qibing Bai, Shuai Wang, Yuhan Du +3Audio TokenizersSelf-Supervised Speech Models

  16. How Bilingual Are SSL Speech Models? Cross-Lingual Probing of Articulatory Encoding with Finnish and Russian EMA

    Jun 30, 2026Ailín Pollio San Pedro, Tomi Kinnunen, Alexandre Nikolaev +1ArticulatorySelf-Supervised Speech Models

  17. Probing-Guided Layer Selection from Self-Supervised Speech Models for Generalizable Audio Deepfake Detection

    Jun 29, 2026Marjan Beheshti, Majid Rostami, Bo ChenSelf-Supervised Speech ModelsNeural Audio

  18. OLIVE: View-Augmented Latent Prediction with Waveform Reconstruction for Speech SSL

    Jun 29, 2026Karl El Hajal, Mathew Magimai. -DossSelf-Supervised Speech ModelsSelf-Supervised Learning

  19. Supervised Post-training of Speech Foundation Models for Robust Adaptation in Speech Deepfake Detection

    Jun 24, 2026Zihan Pan, Sailor Hardik, Jinyang WuSpoofingSelf-Supervised Speech Models

  20. How Well Do Self-Supervised Speech Models Encode Age and Gender in Children's Speech? A Layer-Wise Analysis Across Multiple Architectures

    Jun 20, 2026Abhijit Sinha, Hemant Kumar Kathania, Mohit Joshi +3Self-Supervised Speech ModelsWav2Vec

  21. Online Predictive Coding for Dual-Mode Self-Supervised Speech Model

    Jun 19, 2026Keita Goto, Takashi Maekaku, Jin Sakuma +3Self-Supervised Speech ModelsSelf-Supervised Learning

  22. Perceptual compensation for tonal context in self-supervised speech models

    Jun 16, 2026James Kirby, Ioana Krehan, Michele GubianSelf-Supervised Speech ModelsGrapheme-To-Phoneme

  23. Robust Spoofed Speech Detection via Temporal Pyramid Modeling

    Jun 15, 2026Mahtab Masoudi Nezhad, Nima KarimianSpoofingSelf-Supervised Speech Models

  24. From Self-Supervised Speech Models to Mixture-of-Experts for Robust Anti-Spoofing

    Jun 12, 2026Hugo Daumain, Driss Matrouf, Khaled Khelif +1SpoofingSelf-Supervised Speech Models

  25. Pretrained self-supervised speech models can recognize unseen consonants

    Jun 10, 2026Chihiro Taguchi, Éric Le Ferrand, Hirosi Nakagawa +4Self-Supervised Speech ModelsConsonants

  26. Speaker Group Encoding in Self-supervised Speech Recognition Models

    Jun 9, 2026Felix Herron, Solange Rossato Alexandre Allauzen, Benoit Favre +1Self-Supervised Speech Models

  27. A Comparison of SSL-Based Feature Extractors and Back-End Classifiers for Spoofing Detection: A Multi-Corpus Training and Cross-Linguistic Analysis

    Jun 7, 2026Anh-Tuan Dao, Driss Matrouf, Mickael Rouvier +1SpoofingSelf-Supervised Speech Models

  28. Multilingual Phonological Feature Recognition with Self-Supervised Speech Models

    May 25, 2026Abner Hernandez, Tomás Arias-Vergara, Daiqi Liu +2Self-Supervised Speech ModelsPronunciation Assessment

  29. Enhancing Self-Supervised Talking Head Forgery Detection via a Training-Free Dual-System Framework

    May 5, 2026Ke Liu, Jiwei Wei, Shuchang Zhou +5Face Forgery DetectionSelf-Supervised Speech Models

  30. Dimensionality-Aware Anomaly Detection in Learned Representations of Self-Supervised Speech Models

    May 4, 2026Sandra Arcos-Holzinger, Sarah M. Erfani, James Bailey +1Self-Supervised Speech ModelsWav2Vec

  31. Identifying and typifying demographic unfairness in phoneme-level embeddings of self-supervised speech recognition models

    Apr 24, 2026Felix Herron, Solange Rossato, Alexandre Allauzen +1Self-Supervised Speech ModelsGrapheme-To-Phoneme

  32. Advancing automatic speech recognition using feature fusion with self-supervised learning features: A case study on Fearless Steps Apollo corpus

    Apr 24, 2026Szu-Jui Chen, John H. L. HansenSelf-Supervised Speech ModelsSelf-Supervised Learning

  33. Where Do Self-Supervised Speech Models Become Unfair?

    Apr 20, 2026Felix Herron, Maja Hjuler, Solange Rossato +2Self-Supervised Speech ModelsSpeaker

  34. Prosodic ABX: A Language-Agnostic Method for Measuring Prosodic Contrast in Speech Representations

    Apr 2, 2026Haitong Sun, Stephen McIntosh, Kwanghee Choi +3ProsodySelf-Supervised Speech Models

  35. Adapting Self-Supervised Speech Representations for Cross-lingual Dysarthria Detection in Parkinson's Disease

    Mar 23, 2026Abner Hernandez, Eunjung Yeo, Kwanghee Choi +12Dysarthric SpeechSelf-Supervised Speech Models

  36. Controllable Accent Normalization via Discrete Diffusion

    Mar 15, 2026Qibing Bai, Yuhan Du, Tom Ko +3AccentsSelf-Supervised Speech Models

  37. MauBERT: Universal Phonetic Inductive Biases for Few-Shot Acoustic Units Discovery

    Dec 22, 2025Angelo Ortiz Tandazo, Manel Khentout, Youssef Benchekroun +2Self-Supervised Speech ModelsArticulatory

  38. BabyHuBERT: Multilingual Self-Supervised Learning for Segmenting Speakers in Child-Centered Long-Form Recordings

    Sep 18, 2025Théo Charlot, Tarek Kunze, Maxime Poli +3Self-Supervised Speech Models

  39. An Effective Strategy for Modeling Score Ordinality and Non-uniform Intervals in Automated Speaking Assessment

    Aug 27, 2025Tien-Hong Lo, Szu-Yu Chen, Yao-Ting Sung +1Self-Supervised Speech ModelsProficiency