Full-Duplex Spoken Dialogue Systems

Latest papers 66

All topics
CardsList
  1. DuplexAgent-RSI: Recursive Harness Improvement for Full-Duplex Voice Agent Collaboration

    Oct 8, 2026Yingda Shen, Yuxiang Wang, Kunyu Feng +7LLM Agent HarnessesAgent Harness Optimization

  2. Conversation Is a Two-Body Problem: Dyadic Evaluation of Full-Duplex Dialogue Models

    Oct 6, 2026Sungnyun Kim, Sungwoo Cho, Jihwan Oh +1Multi-Turn Dialogue EvaluationFull-Duplex Spoken Dialogue Systems

  3. HiPLEX: Hierarchical Policy Factorization for Full Duplex Speech Language Models

    Oct 6, 2026Kyudan Jung, Hyunsin Park, Yoonhyung Lee +5RL for Language ModelsSpeech Language Models

  4. DuplexCadence: Exact State and Execution from a Speech Model's Declared Timelines

    Sep 28, 2026Haixiao Gao, Yimin Zheng, Linyou Xiao +1Memory-Efficient InferenceFull-Duplex Spoken Dialogue Systems

  5. SALMONN-duo: Adaptive Dual-System Coordination for Full-Duplex Voice Agents

    Sep 28, 2026Wenyi Yu, Siyin Wang, Terumi Chiba +5LLM Agent OrchestrationTool-Using Language Agents

  6. Controlling Backchannels in Streamable Full-duplex Models

    Sep 24, 2026Maike Züfle, Peter Polák, Sefik Emre Eskimez +3Spoken Dialogue SystemsSpeech Language Models

  7. AdaptDuplex: from static to adaptive full-duplex spoken dialogue

    Sep 24, 2026Zhiyang Zhou, Yingxin Shang, Zhou Wang +9Spoken Dialogue SystemsSpeech Language Models

  8. A Harness for Synthesizing Diverse Naturalistic Full-Duplex Conversations

    Sep 23, 2026Matthew Sun, Vinay Kothapally, Meng Yu +4Spoken Dialogue SystemsSynthetic Data Generation

  9. Qwen-Audio-Agent Technical Report

    Sep 21, 2026Chong Deng, Yunjie Ji, Yuxiang Kong +5Multi-Agent OrchestrationLLM Agent Orchestration

  10. Qwen-Audio-3.1-Realtime: Towards Reliable Agentic Voice Interaction

    Sep 21, 2026Lujia Bao, Qian Chen, Luyao Cheng +15Tool-Augmented Language Model AgentsSpeech Foundation Models

  11. MIRA: Real-Time Full-Duplex Human-Robot Interaction for Embodied Companions

    Sep 21, 2026Lijian Lin, Ye Zhu, Fan Zhang +5Co-Speech Gesture GenerationHuman-Robot Interaction

  12. Full-Duplex Speech Models Take the Floor When Asked, Not When Needed

    Sep 17, 2026Linkai Peng, Baorian Nuchged, Kaiqi Fu +1Language Model Safety EvaluationSpoken Dialogue Systems

  13. SteerDuplex: Steerable Duplex Speech Dialogue Models

    Sep 14, 2026Utkarsh Tyagi, Ramaneswaran Selvakumar, Advait Gosai +13Language Model SteeringSpoken Dialogue Systems

  14. Causal Analysis and Mitigation of Spurious Onsets in Full-Duplex Speech LLMs

    Sep 11, 2026Kento NishiSpeech Language ModelsCausal Interventions in Language Models

  15. DuplexJail: Spoken Interruption Attacks on Full-Duplex Speech Models

    Sep 8, 2026Jaechul Roh, Deepak Chandran, Amir Houmansadr +1Language Model Safety EvaluationJailbreak Attacks

  16. TASTE2: Text-Aligned Speech Modeling and Deployment toward Full-Duplex Voice Interaction

    Sep 8, 2026Yi-Chang Chen, Chun Wei Chen, Dien-Ruei Wu +7TTS SynthesisStreaming TTS Synthesis

  17. KABURI-TTS: Phoneme-Keyed Activity-conditioned Bi-channel Utterance Rendering for Interaction

    Sep 7, 2026Ryuichiro Higashinaka, Shinnosuke Takamichi, Tetsuji OgawaTTS SynthesisControllable Speech Generation

  18. DuplexGen: Adaptive Synthesis of Human-AI Turn-Taking Dialogues

    Jul 28, 2026Takyoung Kim, Kang-wook Kim, Sang Hoon Woo +3Human-in-the-Loop AISynthetic Data Generation for Language Models

  19. Hierarchical Acoustic-Semantic Modeling: Modality Separation and Semantic Coherence for Full-Duplex SLMs

    Jul 7, 2026Zhenyu Liu, Xuanyu Zhang, Yunxin Li +10Speech Language ModelsFull-Duplex Spoken Dialogue Systems

  20. DuplexChat: Constructing Speaker-Separated Full-Duplex Dialogue Speech at Scale for Spoken Dialogue Language Modeling

    Jul 6, 2026Wataru Nakata, Yuki Saito, Hiroshi SaruwatariSpeech ProcessingLanguage Modeling

  21. TurnNat: Automatic Evaluation of Turn-Taking Naturalness in Dyadic Spoken Dialogue

    Jul 1, 2026Hao Zhang, Thomas Thebaud, Georgi Tinchev +2Automated EvaluationFull-Duplex Spoken Dialogue Systems

  22. FacePlex: Toward Natural Full-Duplex Conversational Avatars

    Jun 29, 2026Habin Lim, Hah Min Lew, Jae-Ho Lee +4Audio-Video GenerationTalking Head Generation

  23. Integrating Facial Generation into Full-Duplex Spoken Dialogue Systems

    Jun 20, 2026Jingjing Jiang, Atsumoto Ohashi, Ryuichiro HigashinakaAudio-Driven Facial AnimationMultimodal Generation

  24. BayLing-Duplex: Native Full-Duplex Speech Dialogue with a Single Autoregressive LLM

    Jun 12, 2026Qingkai Fang, Shoutao Guo, Yang FengSpoken Dialogue SystemsSpeech Language Models

  25. Adaptive Turn-Taking for Real-time Multi-Party Voice Agents

    Jun 11, 2026Soumyajit Mitra, Prabhat Pandey, Abhinav Jain +2Spoken Dialogue SystemsSpeech Language Models

  26. Multi-Faceted Interactivity Alignment in Full-Duplex Speech Models

    Jun 9, 2026Atsumoto Ohashi, Neil Zeghidour, Alexandre Défossez +1Spoken Dialogue SystemsMulti-Objective Language Model Alignment

  27. IRAF: Interference-Resilient Adaptive Fusion for Noise-Robust End-to-End Full-Duplex Spoken Dialogue Systems

    Jun 4, 2026Tao Zhong, Jiajun Deng, Nikita Kuzmin +6Spoken Dialogue SystemsMultimodal Fusion

  28. Audio Interaction Model

    Jun 3, 2026Zhifei Xie, Zihang Liu, Ze An +8Audio UnderstandingAudio-Language Models

  29. How Should LLMs Listen While Speaking? A Study of User-Stream Routing in Full-Duplex Spoken Dialogue

    May 11, 2026Hui Lu, Xueyuan Chen, Huimeng Wang +4Language Model RobustnessFull-Duplex Spoken Dialogue Systems

  30. PersonaKit (PK): A Plug-and-Play Platform for User Testing Diverse Roles in Full-Duplex Dialogue

    May 7, 2026Hyunbae Jeon, Jinho D. ChoiVoice Agent EvaluationSpoken Dialogue Systems

  31. Liberating LLM Capabilities in Full-Duplex Speech Models

    May 4, 2026Luoyuan Zhang, Bokai Xu, Junbo Cui +4Speech Language ModelsFull-Duplex Spoken Dialogue Systems