Opencode

Momentum

7 papers in the last four weeks, up 133% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 28

All topics
CardsList
  1. RESUME: Recurrent State Updates from Motion and Residual Signals for Efficient Video Language Modeling

    Sep 30, 2026Can Zhang, Xiaotian Han, Junyuan Shang +5Video-Language ModelsRecurrent State

  2. UniAE-MoE: A Unified Audio Encoder via Mixture of Experts

    Sep 30, 2026Shengbo Cai, Zhisheng Zhang, Zichao Nie +3Large Audio Language ModelsOpencode

  3. Joint Analysis of Latent Dimensionality and Frame Rate in Continuous Audio Encoders

    Sep 24, 2026Kyudan Jung, Sehyun Lee, Son-ha Jo +2OpencodeFrame Rate

  4. Mizar: A 159M-Parameter Audio-Language Model for Audio Understanding

    Sep 23, 2026Kaiyang Li, Shaobo Han, Yue Tian +1Large Audio Language ModelsOpencode

  5. Understanding Hyperspherical Geometry of ECAPA-TDNN Embedding and Its Impact on Zero-Shot Voice Conversion

    Sep 21, 2026Mathilde Abrassart, Nicolas Obin, Axel RoebelVoice ConversionAutomatic Speaker Verification

  6. Multi-Teacher Distillation for Cross-Domain Streaming Electrolaryngeal Speech Encoding

    Sep 16, 2026Benedikt Mayrhofer, Enrique Orozco Olivares, Franz Pernkopf +2Teacher-Student DistillationOpencode

  7. Conjoint Audio-to-Spikes Encoding and Processing for Efficient Neuromorphic Speech Recognition

    Aug 31, 2026Valentin M. Meunier, Amélie Gruel, Pierre Lewden +2Neuromorphic ComputingOpencode

  8. Textual Acoustic Grounding for Generalizable LLM-Based Deepfake Voice Detection

    Aug 31, 2026Yassine El Kheir, Xin Wang, Wanqing Ge +3OpencodeLarge Language Model Fine-Tuning

  9. Geometry-Based Compression of Plenoptic Point Clouds

    Aug 11, 2026Davi R. Freitas, Gustavo L. Sandri, Ricardo L. de QueirozPoint CloudsVolumetric Video

  10. Inference Economics of Enterprise Coding Agents: A Case Study of Cloud vs. On-Premise LLMs

    Jul 13, 2026Sheng-Wei Peng, Yi-Hsun Lin, Yi-Pei LeeCoding AgentsCode Optimization

  11. CARD: Cross-component Audio Representation Distillation for Encoder-Free Audio Captioning

    Jul 6, 2026Ganesh Pavan Kartikeya Bharadwaj Kolluri, Yuchen Zhang, Michael Kampouridis +1OpencodeSentence Encoders

  12. Don't Blame the Large Language Model: How Scaffolding Evolution Shapes Coding Agent Quality

    Jul 4, 2026Oussama Ben Sghaier, Hao Li, Bram Adams +1Coding AgentsSoftware Engineering

  13. Taste-aware music retrieval from audio embeddings

    Jul 3, 2026Matteo Spanio, Antonio RodàMusic Structure AnalysisOpencode

  14. WQ-Fusion: Dynamic Gated Attention for Cross-Domain Audio Representation

    Jun 25, 2026Mingda Lin, Lei Ding, Xinyue Zhou +6OpencodeAdm-Fusion

  15. Generalised Transcoding Framework for Arbitrary Spatial Audio Capture and Playback Formats

    Jun 16, 2026Archontis Politis, Janani Fernandez, Leo McCormackSpatial AudioMicrophone Array

  16. Acoustic Prompting via Stage-wise Modulation for Few-Shot Learning in Audio Language Models

    Jun 14, 2026Hyebin Cho, Jaehyuk Jang, Changick Kim +1OpencodeFew-Shot Learning

  17. Spatio-Temporal Audio Language Modeling for Dynamic Sound Sources

    Jun 12, 2026Oh Hyun-Bin, Kazuki Shimada, Yuhta Takida +6Sound Source LocalizationLarge Audio Language Models

  18. Spatial-Omni: Spatial Audio Understanding Integration in Multimodal LLMs via FOA Encoding

    Jun 9, 2026Zhiyuan Zhu, Yixuan Chen, Yiwen Shao +13Spatial AudioOmni-Modal

  19. MusTBench: Benchmarking and Advancing Temporal Grounding in Music LLMs

    May 28, 2026Daeyong Kwon, Qiyu Wu, Shinobu Kuriya +6Music Structure AnalysisLarge Audio Language Models

  20. AudioMosaic: Contrastive Masked Audio Representation Learning

    May 14, 2026Hanxun Huang, Qizhou Wang, Xingjun Ma +3Neural AudioOpencode

  21. Alethia: A Foundational Encoder for Voice Deepfakes

    Apr 30, 2026Yi Zhu, Brahmi Dwivedi, Jayaram Raghuram +1Deepfake DetectionOpencode

  22. OpenBEATs: A Fully Open-Source General-Purpose Audio Encoder

    Jul 18, 2025Shikhar Bharadwaj, Samuele Cornell, Kwanghee Choi +4Neural AudioAudio Understanding