Gated Deltanet

Momentum

8 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 6Week of Sep 21

Latest papers 43

All topics
CardsList
  1. LeapQuant: Efficient Linear Attention with Accurate Recurrent State Quantization

    Sep 29, 2026Yi Pan, Haocheng Xi, Kan Zhu +10Large Language Model QuantizationKimi Delta Attention

  2. DeltaSeek: Toward Active Perception in Evolving Construction Environments

    Sep 27, 2026Sanjay Acharjee, Md Nazmus SakibViewpoint-Dependent Active PerceptionRobot Systems

  3. DeltaWAM: Delta World Action Models for Bimanual Manipulation

    Sep 23, 2026Han Yan, Zishang Xiang, Haokai Jiang +6Recent World-Action ModelsWorld Models

  4. DASC: Decay-Aware State Compression for Hybrid Linear-Attention Serving

    Aug 31, 2026Yanqi Yu, Pingwei Sun, Jianchao Tan +4Kimi Delta AttentionRecurrent State

  5. Tail-Replay: Escaping the Curse of Linear Attention in Prefix Caching for Hybrid LLMs

    Aug 31, 2026Yirui Liu, Ruoling Qi, Xuaner Wu +2Kimi Delta AttentionLinear Attention

  6. DAMP: Decay-Aware Mixed-Precision Recurrent-State Quantization

    Aug 27, 2026Tao Zhang, Jianchao Tan, Pingwei Sun +6Recurrent StateGated Deltanet

  7. Deltoris: Enabling Real-time VLA Inference in Embodied AI via Bit-level Sparsity and Speculative Inference

    Aug 5, 2026Zheng Liu, Zeyu Guo, Zihan Liu +9Diffusion-Based Vision-Language-ActionsEmbodied Artificial Intelligence

  8. Zero-Observation User Reactivation with Gap-Driven Dimensional Gating

    Jul 22, 2026Jiandong Ding, Tianying Liu, Fuyuan Liu +2Sequential RecommendationDiscontinuous Gating

  9. DeltaMerge-LowRes: Composing Language and Task Deltas for Low-Resource Adaptation

    Jul 15, 2026Son Ha Xuan, Xuan-Bach Le, Phat T. Tran-TruongLarge Language Model AdaptationMotion-Language Alignment

  10. DeltaV: Thinking with Visual State Updates in Unified Large Multimodal Models

    Jul 9, 2026Pengjie Wang, Linger Deng, Zujia Zhang +6Large Multimodal ModelsMultimodal Reasoning

  11. Linear Attention Architectures: Mechanisms, Trade-offs, and Cross-Layer Routing

    Jul 8, 2026Tommaso Cerruti, Tim Rieder, George Rowlands +2Kimi Delta AttentionLinear Attention

  12. DeLS-Spec: Decoupled Long-Short Contexts for Parallel Speculative Drafting

    Jul 8, 2026Hong-Kai Zheng, Piji LiSpeculative DecodingDrafter

  13. Sparse Delta Memory: Scaling the State of Linear RNNs through Sparsity

    Jul 8, 2026Loïc Cabannes, Pierre-Emmanuel Mazaré, Gergely Szilvasy +6Kimi Delta AttentionEfficient Long-Context Inference

  14. DELTAVID: Enhancing Fine-Grained Spatiotemporal Perception with Cross-Video Differences

    Jun 26, 2026Yankai Yang, Yancheng Long, Bin Wen +4Fine-Grained Video UnderstandingVideo Understanding

  15. Taylor-Calibrate: Principled Initialization for Hybrid Linear Attention Distillation

    Jun 15, 2026Zhongzhu Zhou, Qingyang Wu, Junxiong Wang +4Transformer ArchitecturesGated Deltanet

  16. On Subquadratic Architectures: From Applications to Principles

    Jun 10, 2026Anamaria-Roberta Hartl, Levente Zólyomi, David Stap +6Sequence ModelingLinear Attention

  17. When Good Enough Is Optimal: Multiplication-Only Matrix Inversion Approximation for Quantized Gated DeltaNet

    Jun 4, 2026Luoming Zhang, Yuwei Ren, Kui Zhang +7Matrix MultiplicationKimi Delta Attention

  18. DELTAMEM: Incremental Experience Memory for LLM Agents via Residual Trees

    Jun 2, 2026Haoran Tan, Zeyu Zhang, Zhicheng Cao +2Large Language Model AgentsGated Deltanet

  19. Don't Read Everything: A Curvature-Conditioned Query for Linear Attention

    May 31, 2026Dong Le, Thong Nguyen, Cong-Duy Nguyen +1Kimi Delta AttentionLinear Attention

  20. Multi-Mixer Models: Flexible Sequence Modeling with Shared Representations

    May 27, 2026Kevin Y. Li, Asher Trockman, Ananda Theertha Suresh +1Asymmetric Grouped-Attention Variate MixerSequence Modeling

  21. DeltaMCP: Incremental Regeneration via Spec-Aware Transformation for MCP servers

    May 27, 2026Aditya Pujara, Xiaogang Zhu, Hsiang-Ting ChenModel Context ProtocolGated Deltanet

  22. Patched-DeltaNet: Token-Level Event-Driven Memory for Linear-Time Anomaly Detection

    May 27, 2026Tae-Gyun Lee, Junyoung Park, Kyu Won HanTime-Series Anomaly DetectionGated Deltanet

  23. DeltaCam: Differential Intrinsic Camera Modeling for Video Generation

    May 24, 2026Debabrata Mandal, Zhihan Peng, Yujie Wang +1Camera ControlLong Video Generation

  24. Which Way Did It Move? Diagnosing and Overcoming Directional Motion Blindness in Video-LLMs

    May 21, 2026Jongseo Lee, Hyuntak Lee, Sunghun Kim +3Spatial BlindnessMotion

  25. DeltaBox: Scaling Stateful AI Agents with Millisecond-Level Sandbox Checkpoint/Rollback

    May 21, 2026Yunpeng Dong, Jingkai He, Shiqi Liu +7SandboxRollback

  26. Provably Shorter Scratchpads in Hybrid DeltaNet-Attention Decoders

    May 15, 2026Tomasz SteiferKimi Delta AttentionGated Deltanet

  27. OSDN: Improving Delta Rule with Provable Online Preconditioning in Linear Attention

    May 13, 2026Chenyu Zhou, Hongpei Li, Yuerou Liu +3Kimi Delta AttentionLinear Attention

  28. Mixture of Layers with Hybrid Attention

    May 10, 2026Ivan Ternovtsii, Yurii BilakTransformer AttentionMixture-Of-Experts

  29. DeltaRubric: Generative Multimodal Reward Modeling via Joint Planning and Verification

    May 10, 2026Rui Liu, Dian Yu, Zhenwen Liang +6Rubric-Based ScoringVisual Reasoning

  30. Kaczmarz Linear Attention

    May 9, 2026Jiaxuan Zou, Ruifeng Ren, Yong LiuKimi Delta AttentionRecurrent Model

  31. Priming: Hybrid State Space Models From Pre-trained Transformers

    May 8, 2026Aditya Chattopadhyay, Elvis Nunez, Prannay Kaul +6Generative Pretrained TransformersPriming

  32. MDN: Parallelizing Stepwise Momentum for Delta Linear Attention

    May 7, 2026Yulong Huang, Xiang Liu, Hongxiang Huang +5Kimi Delta AttentionLinear Attention

  33. DeltaSeg: Tiered Attention and Deep Delta Learning for Multi-Class Structural Defect Segmentation

    Apr 20, 2026Enrique Hernandez Noguera, Md Meftahul Ferdaus, Elias Ioup +1U-NetDefect Detection

  34. DeltaDeno: Zero-Shot Anomaly Generation via Delta-Denoising Attribution

    Nov 21, 2025Chaoran Xu, Chengkan Lv, Qiyu Chen +3Iterative Denoising MethodsGated Deltanet