Gated Delta Networks

Latest papers 15

All topics
CardsList
  1. Voltic: Distinguishing Volatility from Stochasticity in Recurrent Memory

    Oct 5, 2026Parsa Hejabi, Morteza Dehghani, Payam PirayKalman FilteringBayesian Filtering

  2. DeltaFlow: Noise-Adaptive Bidirectional Gated Delta Networks for Embedded Language Flows

    Aug 2, 2026Guangfu Guo, Xiaoqian Lu, Linsey Pang +4Gated Delta NetworksDiffusion Language Models

  3. Linear Attention Architectures: Mechanisms, Trade-offs, and Cross-Layer Routing

    Jul 8, 2026Tommaso Cerruti, Tim Rieder, George Rowlands +2Linear AttentionDelta-Rule Linear Attention

  4. Sparse Delta Memory: Scaling the State of Linear RNNs through Sparsity

    Jul 8, 2026Loïc Cabannes, Pierre-Emmanuel Mazaré, Gergely Szilvasy +6Long-Context RetrievalMemory-Augmented Language Models

  5. Taylor-Calibrate: Principled Initialization for Hybrid Linear Attention Distillation

    Jun 15, 2026Zhongzhu Zhou, Qingyang Wu, Junxiong Wang +4Neural Network InitializationLinear Attention

  6. SinkRec: Mitigating Semantic State Sink in Long Sequence Recommendation with Memory-Conditioned Gated Delta Networks

    Jun 3, 2026Zhuang Zhuang, Zhipeng Wei, Ji Dai +4Memory-Augmented Neural NetworksSequential Recommendation

  7. Unlocking Feature Learning in Gated Delta Networks at Scale

    Jun 2, 2026Yifeng Liu, Quanquan GuNeural Network OptimizationHyperparameter Transfer

  8. Patched-DeltaNet: Token-Level Event-Driven Memory for Linear-Time Anomaly Detection

    May 27, 2026Tae-Gyun Lee, Junyoung Park, Kyu Won HanGated Delta NetworksTime-Series Anomaly Detection

  9. Provably Shorter Scratchpads in Hybrid DeltaNet-Attention Decoders

    May 15, 2026Tomasz SteiferGated AttentionRecurrent Transformers

  10. Kaczmarz Linear Attention

    May 9, 2026Jiaxuan Zou, Ruifeng Ren, Yong LiuLong-Context Language ModelingRecurrent Transformers