Streaming

Momentum

20 papers in the last four weeks, up 18% on the four weeks before. 0.2% of all new papers.

Jul 6Week of Sep 21

Latest papers 171

All topics
CardsList
  1. Pretraining EHR Foundation Models with Patient-Aware Sampling

    Jul 24, 2026Joshua Placidi, Yuxuan Liu, Jinpei Han +2Medical World ModelMimic-Iv Datasets

  2. Streaming Multi-Agent Autoregressive Diffusion Model with World State Registers

    Jul 23, 2026Sicheng Mo, Yuheng Li, Ziyang Leng +2Video World ModelsAutoregressive Video Diffusion Models

  3. Online Variance Reduction for Domain Adaptation on Streaming Data

    Jul 22, 2026Andrea NapoliVariance ReductionDomain Adaptation

  4. StreamHOI: Interaction-aware Temporal Memory Adaptation for Streaming HOI Video Generation

    Jul 22, 2026Zejing Rao, Haoxian Zhang, Xiaoqiang Liu +5StreamingPeak Memory

  5. IGGT4D: Streaming 4D Instance-Grounded Geometry Transformer

    Jul 21, 2026Zhengyu Zou, Hao Li, Kuixuan Jiao +7Visual Geometry Grounded Transformer4D Reconstruction

  6. Sobek: Streaming Equivariant Tensor Product Convolutions

    Jul 20, 2026Vladimir Chorošajev, Cédric BényConvolutionalGraph Neural Networks

  7. Video = World + Event Stream

    Jul 16, 2026Lianghua Huang, Zhi-Fan Wu, Yupeng Shi +24StreamingMultimodal Understanding

  8. M4^\text{4}World: A Multi-view Multimodal Driving World Model for Interactive Object Manipulation and Minute-long Streaming

    Jul 15, 2026Ke Cheng, Hanqiao Ye, Lei Shi +8Autonomous Driving SimulationWorld Models

  9. Robust Federated Learning Under Real-World Client Churn

    Jul 8, 2026Dhruv Garg, Neha Lakhani, Debopam Sanyal +3Federated LearningHeterogeneity

  10. ARMS: Anchor-Relational Motion Streaming for Seamless Solo-Social Motion Transitions

    Jul 7, 2026Huakun Liu, Qing Yu, Kent Fujiwara +2Human Motion GenerationHuman Motion

  11. ReCal3R: Reliability-Calibrated Learning Rates for Streaming 3D Reconstruction

    Jul 6, 2026Xinze Li, Yiyuan Wang, Pengxu Chen +43D ReconstructionRecurrent State

  12. S-EMBER: A Large-Scale Benchmark for Streaming Egocentric Memory Retrieval

    Jul 2, 2026Xiaodong Wang, Xuanyi Zhao, Pedro Rodriguez +7Episodic MemoryStreaming

  13. MedStreamBench: A Time-Aware Benchmark for Streaming and Proactive Medical Video Understanding

    Jul 2, 2026Yuan Wang, Shujian Gao, Songtao Jiang +2Medical Visual Question AnsweringDiagnostic Benchmark

  14. TiRex-2: Generalizing TiRex to Multivariate Data and Streaming

    Jul 1, 2026Patrick Podest, Marco Pichler, Elias Bürger +7Time Series Foundation ModelsAsymmetric Grouped-Attention Variate Mixer

  15. NPUsper: Eliminating Redundant Computation for Real-Time Whisper on Mobile NPUs

    Jul 1, 2026Sihyeon Lee, Hojeong Lee, Sungwon Woo +3Whisper-Large-V3Neural Processing Units

  16. PedNStream: Scalable Network Flow Simulation for Pedestrian Traffic Management

    Jul 1, 2026Weiming Mai, Dorine Duives, Serge HoogendoornMicroscopic Traffic SimulationsFlow Models

  17. Hybrid Active-Online Learning Framework for Label-Efficient Concept Drift Adaptation in Optical Network Failure Detection

    Jun 29, 2026Yousuf Moiz Ali, Jaroslaw E. Prilepsky, João Pedro +4Pool-Based Active LearningLabel Propagation

  18. DLGStream: Dynamic Language-embedded Guassian Splatting for Open-vocabulary Enabled Free-viewpoint Video Streaming

    Jun 27, 2026Zhihui Ke, Yuyang Liu, Xiaobo Zhou +1Volumetric VideoStreaming

  19. Uncertainty-Aware Sequential Decision Rules for Event-Triggered LLM Invocation in Streaming Systems

    Jun 27, 2026Zhaohui WangStreaming InferenceLarge Language Models Fail

  20. Wan-Streamer v0.1: End-to-end Real-time Interactive Foundation Models

    Jun 23, 2026Lianghua Huang, Zhi-Fan Wu, Wei Wang +22StreamingFull-Duplex Speech Models

  21. InteractiveAvatar: Real-Time Streaming Video Generation for Consistent and Intent-Aware Avatars

    Jun 22, 2026Quanyue Song, Yishan He, Yanfei Zhang +6Interactive Video GenerationAvatars

  22. CoVStream: Edge-Cloud Collaboration for Understanding of Long Video Streams

    Jun 22, 2026Xu Liu, Guikun Chen, Zihao Yan +2Streaming VideoEdge Platforms

  23. Streaming T5-based Text-to-Speech Synthesis with Limited Lookahead

    Jun 20, 2026Muyang Du, Jason Roche, Junjie LaiText-To-Speech SynthesisF5-Tts

  24. DataClaw0: Agentic Tailoring Multimodal Data from Raw Streams

    Jun 19, 2026Cong Wan, Zeyu Guo, Zijian Cai +6Multimodal Continual Instruction TuningData Science Agents

  25. Zero-VC: Zero-Lookahead Streaming Voice Conversion via Speaker Anonymization

    Jun 18, 2026Yudong Li, Zihao Fang, Junwen Qiu +4SpeakerProsody

  26. ViCoStream: Streaming VideoLLMs Can Run Beyond 100 FPS with Stage-Wise Coordinated Inference

    Jun 18, 2026Yang Tan, Junlong Tong, Linan Yue +3Streaming VideoStreaming

  27. What Should a Streaming Video Model Remember?

    Jun 15, 2026Haonan Ge, Yiwei Wang, Hang Wu +1Streaming Video UnderstandingStreaming

  28. Efficiency-Performance Trade-offs in Neural Speaker Diarization via Structured Pruning and Low-Bit Quantization

    Jun 12, 2026Rishit Chatterjee, Tahiya ChowdhurySpeaker DiarizationNeural Speech Codecs

  29. Renewable Lasso without Batch-Number Constraints: A Gradient-Enhanced Approach

    Jun 10, 2026Junzhuo Gao, Ling Peng, Xu Guo +1Surrogate GradientStochastic Gradient Descent

  30. Decision-Calibrated Conformal Uncertainty for Pacing Decisions in Streaming Advertising

    Jun 8, 2026Prashant Shekhar, Caroline HowardCalibrated UncertaintyAds

  31. Structured Adaptive Tensor Prediction for Streaming Data

    Jun 8, 2026Zhen Qin, Yang ChenMultivariate Time-SeriesAutoregressive Model

  32. Streaming Interventions: Can Video Large Language Models Correct Mistakes as They Occur?

    Jun 8, 2026Apratim Bhattacharyya, Shweta Mahajan, Sanjay Haresh +5Large Language Models FailInstruction-Tuned Models

  33. MeanVC 2: Robust Low-Latency Streaming Zero-Shot Voice Conversion

    Jun 8, 2026Guobin Ma, Yuxuan Xia, Yuepeng Jiang +6Voice ConversionStreaming

  34. A Unifying View of Attention Sinks: Two Algorithms, Two Solutions

    Jun 6, 2026Lukas Fesser, Mozes Jacobs, Thomas Fel +2PerspectiveStreaming

  35. Streaming Video Generation with Streaming Force Control

    Jun 5, 2026Hanhui Wang, Yiming Xie, Haiwen Feng +3StreamingUnified Representation

  36. Streaming Communication in Multi-Agent Reasoning

    Jun 3, 2026Zhen Yang, Xiaogang Xu, Wen Wang +3Multi-Agent ReasoningStreaming

  37. UltraEP: Unleash MoE Training and Inference on Rack-Scale Nodes with Near-Optimal Load Balancing

    Jun 2, 2026Xinming Wei, Chao Jin, Tuo Dai +10Load BalancingMixture-Of-Expert Inference

  38. FreeStreamGS: Online Feed-forward 3D Gaussian Splatting from Unposed Streaming Inputs

    Jun 2, 2026Ruiyang Chen, Feiran Li, Chu Zhou +3Feed-Forward 3D GaussianFeed-Forward 3D Gaussian Splatting

  39. X-Stream: Exploring MLLMs as Multiplexers for Multi-Stream Understanding

    Jun 1, 2026Peiwen Sun, Xudong Lu, Huadai Liu +10StreamingMultimodal Large Language Models

  40. Dex2HOI: Dexterous Bimanual Two-Object Interaction Generation

    May 28, 2026Chrysa Pratikaki, Pablo Ruiz-Ponce, Jiankang Deng +2Hand-Object Interaction DetectionArticulated Objects

  41. Make LLM Learn to Synthesize from Streaming Experiences through Feedback

    May 28, 2026Zhenlin Hu, Yan Wang, Zhen Bi +7SynthesizerSynagent

  42. DiscoForcing: A Unified Framework for Real-Time Audio-Driven Character Control with Diffusion Forcing

    May 27, 2026Kaiyang Ji, Bingsheng Qian, Binghuan Wu +3DuetAutoregressive Diffusion

  43. EchoAvatar: Real-time Generative Avatar Animation from Audio Streams

    May 27, 2026Bohong Chen, Yumeng Li, Yinglin Xu +3AvatarsHuman Motion Generation

  44. RW-TTT: Batched Serving for Request-Owned Test-Time Training State

    May 27, 2026Jian Yang, Zhizhuo Kou, Yao Tian +4Large Language Model ServingTime-To-First-Token

  45. OmniMem: Perturbation-aware Memory Compression for Streaming Audio-Visual LLMs

    May 26, 2026Guangzhi Sun, Yixuan Li, Yudong Yang +1Modern Data-Streaming SystemsLarge Audio Language Models