Full-Duplex Spoken Dialogue Systems

Latest papers 66

All topics
CardsList
  1. KABURI-TTS: Phoneme-Keyed Activity-conditioned Bi-channel Utterance Rendering for Interaction

    Sep 7, 2026Ryuichiro Higashinaka, Shinnosuke Takamichi, Tetsuji OgawaTTS SynthesisControllable Speech Generation

  2. DuplexGen: Adaptive Synthesis of Human-AI Turn-Taking Dialogues

    Jul 28, 2026Takyoung Kim, Kang-wook Kim, Sang Hoon Woo +3Human-in-the-Loop AISynthetic Data Generation for Language Models

  3. Hierarchical Acoustic-Semantic Modeling: Modality Separation and Semantic Coherence for Full-Duplex SLMs

    Jul 7, 2026Zhenyu Liu, Xuanyu Zhang, Yunxin Li +10Speech Language ModelsFull-Duplex Spoken Dialogue Systems

  4. DuplexChat: Constructing Speaker-Separated Full-Duplex Dialogue Speech at Scale for Spoken Dialogue Language Modeling

    Jul 6, 2026Wataru Nakata, Yuki Saito, Hiroshi SaruwatariSpeech ProcessingLanguage Modeling

  5. TurnNat: Automatic Evaluation of Turn-Taking Naturalness in Dyadic Spoken Dialogue

    Jul 1, 2026Hao Zhang, Thomas Thebaud, Georgi Tinchev +2Automated EvaluationFull-Duplex Spoken Dialogue Systems

  6. FacePlex: Toward Natural Full-Duplex Conversational Avatars

    Jun 29, 2026Habin Lim, Hah Min Lew, Jae-Ho Lee +4Audio-Video GenerationTalking Head Generation

  7. Integrating Facial Generation into Full-Duplex Spoken Dialogue Systems

    Jun 20, 2026Jingjing Jiang, Atsumoto Ohashi, Ryuichiro HigashinakaAudio-Driven Facial AnimationMultimodal Generation

  8. BayLing-Duplex: Native Full-Duplex Speech Dialogue with a Single Autoregressive LLM

    Jun 12, 2026Qingkai Fang, Shoutao Guo, Yang FengSpoken Dialogue SystemsSpeech Language Models

  9. Adaptive Turn-Taking for Real-time Multi-Party Voice Agents

    Jun 11, 2026Soumyajit Mitra, Prabhat Pandey, Abhinav Jain +2Spoken Dialogue SystemsSpeech Language Models

  10. Multi-Faceted Interactivity Alignment in Full-Duplex Speech Models

    Jun 9, 2026Atsumoto Ohashi, Neil Zeghidour, Alexandre Défossez +1Spoken Dialogue SystemsMulti-Objective Language Model Alignment

  11. IRAF: Interference-Resilient Adaptive Fusion for Noise-Robust End-to-End Full-Duplex Spoken Dialogue Systems

    Jun 4, 2026Tao Zhong, Jiajun Deng, Nikita Kuzmin +6Spoken Dialogue SystemsMultimodal Fusion

  12. Audio Interaction Model

    Jun 3, 2026Zhifei Xie, Zihang Liu, Ze An +8Audio UnderstandingAudio-Language Models

  13. How Should LLMs Listen While Speaking? A Study of User-Stream Routing in Full-Duplex Spoken Dialogue

    May 11, 2026Hui Lu, Xueyuan Chen, Huimeng Wang +4Language Model RobustnessFull-Duplex Spoken Dialogue Systems

  14. PersonaKit (PK): A Plug-and-Play Platform for User Testing Diverse Roles in Full-Duplex Dialogue

    May 7, 2026Hyunbae Jeon, Jinho D. ChoiVoice Agent EvaluationSpoken Dialogue Systems

  15. Liberating LLM Capabilities in Full-Duplex Speech Models

    May 4, 2026Luoyuan Zhang, Bokai Xu, Junbo Cui +4Speech Language ModelsFull-Duplex Spoken Dialogue Systems