Recurrent State

Momentum

22 papers in the last four weeks, up 267% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 70

All topics
CardsList
  1. ALER: Adaptive Learnable Experience Rewriting for Reinforcement Learning

    Sep 30, 2026Oleg Shchendrigin, Egor Cherepanov, Aleksandr I. Panov +1Prioritized Experience ReplayOffline Reinforcement Learning

  2. What Limits Recursive Reasoning Models: Optimization, Architecture and Test-Time Scaling

    Sep 30, 2026Yuliana Shakhvalieva, Dmitrii Kharchev, Viacheslav Bezrukov +4Recursive ModelsLarge Reasoning Models

  3. RESUME: Recurrent State Updates from Motion and Residual Signals for Efficient Video Language Modeling

    Sep 30, 2026Can Zhang, Xiaotian Han, Junyuan Shang +5Video-Language ModelsRecurrent State

  4. NeurDuo-EEG: A Long-Sequence EEG Foundation Model with Persistent State and Explicit Memory

    Sep 29, 2026Yifan Wang, Haiping Liu, Yang Cui +13Electroencephalography Foundation ModelsElectroencephalography

  5. What Pretraining and Midtraining Make Learnable from Rewards?

    Sep 29, 2026Chiwun Yang, Xiaoyu LiReinforcement Learning Post-TrainingPretraining

  6. STEPQuant: When and Where Errors Matter in Delta-Rule Recurrent State Quantization

    Sep 29, 2026Bingchen Yao, Haobo Xu, Haokun Lin +6Recurrent StateKimi Delta Attention

  7. LeapQuant: Efficient Linear Attention with Accurate Recurrent State Quantization

    Sep 29, 2026Yi Pan, Haocheng Xi, Kan Zhu +10Large Language Model QuantizationKimi Delta Attention

  8. Pretraining Latent Information Feedback Transformers with Teacher Supervision

    Sep 29, 2026Dor Tirosh, Ido Amos, Mor GevaTransformer ArchitecturesPretraining

  9. Procedural Core: A Compact Recurrent Initialization for Vision Transformers

    Sep 29, 2026Zachary Shinnick, Christian Internò, Hemanth Saratchandran +2Transformer ArchitecturesImagenet

  10. Reasoning on the Simplex: Geometric Fixed-Point Models

    Sep 27, 2026Talgat Daulbaev, Ilya Glazkov, Maxim Rakhuba +1Recursive ReasonerSimplex

  11. SketchSSM: Write to the Full State, Read from a Compact Sketch

    Sep 27, 2026Omin Kwon, JoongWon Shin, Minseo Kim +3Kimi Delta AttentionLarge Language Model Decoding

  12. Tracking States or Tracking Cosets? An Algebraic Account of Learned State Tracking

    Sep 24, 2026Zhiyu Zhang, Yupeng LiFinite GroupsRecurrent State

  13. Non-Commutative State Tracking with Input-Dependent Low-Rank Updates in Mamba-3

    Sep 23, 2026Hiroki Fujii, Masaki YamakitaRecurrent StateMamba

  14. DeltaS: Reading the Gated Linear Attention State for KV Cache Eviction in Streaming Video

    Sep 23, 2026Taeyoun Kwon, Seungjin Kim, Hyeonyu Kim +1Kimi Delta AttentionLinear Attention

  15. Thinking with Looped Flows

    Sep 12, 2026Ayhan Suleymanzade, Chanhyuk Lee, Floor Eijkelboom +3Deep LearningRecurrent State

  16. Separating Stream Stability from Long-Term Recall in Language Models

    Sep 7, 2026Peipei Cao, Xin Zhang, Jie Tang +3Large Language Model MemoryEfficient Long-Context Inference

  17. When Quantization Breaks Memory: Recurrent-State Write-Back in Low-Precision Temporal Inference

    Sep 7, 2026Ismail Erbas, Xavier Intes, Vikas PandeyRecurrent StateBackward Passes

  18. DASC: Decay-Aware State Compression for Hybrid Linear-Attention Serving

    Aug 31, 2026Yanqi Yu, Pingwei Sun, Jianchao Tan +4Kimi Delta AttentionRecurrent State

  19. Tail-Replay: Escaping the Curse of Linear Attention in Prefix Caching for Hybrid LLMs

    Aug 31, 2026Yirui Liu, Ruoling Qi, Xuaner Wu +2Kimi Delta AttentionLinear Attention

  20. DAMP: Decay-Aware Mixed-Precision Recurrent-State Quantization

    Aug 27, 2026Tao Zhang, Jianchao Tan, Pingwei Sun +6Recurrent StateGated Deltanet

  21. DreamGuard: Efficient Runtime Guardrail for LLM Agents via Risk-Aware World Model

    Aug 6, 2026Wenhao Lin, Chenyu Yu, Xingwei Lin +6Runtime Safety FilteringLarge Language Model Agents

  22. DART: Decoded Attention over Recurrent States for Efficient Long-Context Sequence Modeling

    Aug 3, 2026Yixiao Qian, Song Chen, Pengkai Wang +3Recurrent StateKimi Delta Attention

  23. Looped Transformers with Source-Centered State Evolution

    Jul 30, 2026Bum Jun Kim, Kohei Hayashi, Shunsuke Kamiya +3Recurrent StateTransformer Architectures

  24. Memory for Large Language Models

    Jul 28, 2026Sining Zhoubian, Dan Zhang, Evgeny Kharlamov +1Large Language Model MemoryPeak Memory

  25. Enhancing Personalized Bladder Cancer Treatment Through Reinforcement Learning: A Recurrent Patient State Transition Decision Support Framework

    Jul 18, 2026Divyansh Chawla, Anshu Garg, Isshaan SinghRecurrent StatePatient Trajectories

  26. SpecLA: Efficient Speculative Decoding for Linear-Attention Models

    Jul 18, 2026Zhibin Wang, Xuying Han, Zhaohua Yang +5Speculative DecodingKimi Delta Attention

  27. Structured Fluctuations and the Information Dynamics of Self-Maintenance in Growing Neural Cellular Automata

    Jul 14, 2026Atsushi Masumori, Hiroki Sato, Takashi IkegamiNeural Cellular AutomataSelf-Repair

  28. ReCal3R: Reliability-Calibrated Learning Rates for Streaming 3D Reconstruction

    Jul 6, 2026Xinze Li, Yiyuan Wang, Pengxu Chen +43D ReconstructionRecurrent State

  29. SHiPPO: Recurrent Memory with Transported Polynomial Projections

    Jul 3, 2026Tomoya Mizuguchi, Bum Jun KimRecurrent ModelRecurrent State

  30. StateFlow: Dual-State Recurrent Modeling for Long-Horizon Time Series Forecasting

    Jun 30, 2026Haroon Gharwi, Yue Dai, Kai ShuRetrieval-Augmented ForecastingTime Series Forecasting

  31. Q-Delta: Beyond Key-Value Associative State Evolution

    Jun 7, 2026Sumin Park, Seojin Kim, Noseong ParkKimi Delta AttentionRecurrent State

  32. SinkRec: Mitigating Semantic State Sink in Long Sequence Recommendation with Memory-Conditioned Gated Delta Networks

    Jun 3, 2026Zhuang Zhuang, Zhipeng Wei, Ji Dai +4Recurrent StateKimi Delta Attention

  33. Don't Read Everything: A Curvature-Conditioned Query for Linear Attention

    May 31, 2026Dong Le, Thong Nguyen, Cong-Duy Nguyen +1Kimi Delta AttentionLinear Attention

  34. Zamba2-VL Technical Report

    May 29, 2026Hassan Shapourian, Kasra Hejazi, Olabode M. Sule +1Hybrid Mamba-Transformer ModelRecent Vision-Language Models

  35. Forget Less, Generalize More: Unifying Temporal and Structural Adaptation for Dynamic Graphs

    May 28, 2026Qian Chang, Ciprian Doru Giurcaneanu, Runsong Jia +6Recurrent StateRapid Adaptation

  36. Tensor Memory: Fixed-Size Recurrent State for Long-Horizon Transformers

    May 26, 2026Kabir Swain, Sijie Han, Daniel Karl I. Weidele +2Recurrent StateRecurrent Model

  37. Interaction Locality in Hierarchical Recursive Reasoning

    May 20, 2026Yosuke Miyanishi, Tetsuro MorimuraSpatial Reasoning3D Visual Grounding

  38. Learned Memory Attenuation in Sage-Husa Kalman Filters for Robust UAV State Estimation

    May 18, 2026Kenan Majewski, Marcin ŻugajExtended Kalman FilterCovariance

  39. PH-Dreamer: A Physics-Driven World Model via Port-Hamiltonian Generative Dynamics

    May 18, 2026Xueyu Luan, Chenwei ShiWorld ModelsHamiltonian