Audio Editing

Momentum

7 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 41

All topics
CardsList
  1. DirectAudioEdit: Inversion-Free Text-Guided Audio Editing via Diffusion Prediction Contrast

    Jun 5, 2026Zhengkun Ge, Xiaoqian Liu, Haoran Zhang +5Audio EditingAudio Diffusion Models

  2. MMAE: A Massive Multitask Audio Editing Benchmark

    Jun 5, 2026Ziyang Ma, Ruiqi Yan, Ruiyang Xu +35Audio Editing

  3. SpeechEditBench: A Bilingual Multi-Attribute Benchmark for Instruction-Guided Speech Editing

    Jun 1, 2026Hanlin Zhang, Daxin Tan, Dehua Tao +3Audio-Language Model EvaluationAudio Editing

  4. UNISON: A Unified Sound Generation and Editing Framework via Deep LLM Fusion

    May 29, 2026Zhaoqing Li, Haoning Xu, Jingran Su +9Text-to-Audio GenerationTTS Synthesis

  5. AnchorSteer: Self-Discovered Concept Injection for Structure-Preserving Music Editing

    May 29, 2026Chih-Heng Chang, Keng-Seng Ho, Chih-Yu Tsai +3Audio EditingControllable Music Generation

  6. Stable Audio 3

    May 18, 2026Zach Evans, Julian D. Parker, Matthew Rice +4Text-to-Audio GenerationLatent Diffusion Models

  7. Exploring Token-Space Manipulation in Latent Audio Tokenizers

    May 11, 2026Francesco Paissan, Luca Della Libera, Mirco Ravanelli +1Audio Representation LearningNeural Audio Codecs

  8. Polyphonia: Zero-Shot Timbre Transfer in Polyphonic Music with Acoustic-Informed Attention Calibration

    May 11, 2026Haowen Li, Tianxiang Li, Yi Yang +2Audio EditingControllable Music Generation

  9. AST: Adaptive, Seamless, and Training-Free Precise Speech Editing

    Apr 17, 2026Sihan Lv, Yechen Jin, Zhen Li +5TTS SynthesisAudio Editing

  10. SemanticAudio: Audio Generation and Editing in Semantic Space

    Jan 29, 2026Zheqi Dai, Guangyan Zhang, Haolin He +5Text-to-Audio GenerationAudio Editing

  11. CosyEdit: Unlocking End-to-End Speech Editing Capability from Zero-Shot Text-to-Speech Models

    Jan 8, 2026Junyang Chen, Yuhang Jia, Hui Wang +2Audio EditingSpeech Editing