Deterministic Replay

Momentum

4 papers in the last four weeks, up 33% on the four weeks before. 0.0% of all new papers.

Jul 6Week of Sep 21

Latest papers 31

All topics
CardsList
  1. EverMine: Dissecting the Self-Evolution of Research Capabilities in Long-Horizon Alpha Research

    Sep 27, 2026Siyuan Li, Jiangfeng Zhang, Rui Yao +3Self-EvolutionPortfolio Construction

  2. Beyond Class Marginals: Bounding Rehearsal Gaps without Freezing Class Co-occurrence

    Sep 22, 2026Congren Dai, Nat Roongjirarat, Fei YeLayer-Selective Rehearsal StrategyDeterministic Replay

  3. EvolveScaler: Synthesizing Information-Evolution Contexts via Executable State Machines and Natural-Language Rendering

    Sep 8, 2026Ziliang Zhao, Zenan Xu, Shuting Wang +6AlphaevolveAutomata

  4. Toward Integrating Adaptive Experience Replay and Online Uncertainty Estimation in Safe Actor-Critic Optimal Control

    Aug 5, 2026Mahshad Rastegarmoghaddam, Davoud Nikkhouy, Shima SamadzadehControl Barrier FunctionsSoft Actor-Critic

  5. Beyond Single-Use Tokens: Durable Authorization State for Replay-Resistant LLM Agent Actions

    Aug 3, 2026Jinghan Xu, Longze Fan, Zeyuan Wang +2Deterministic ReplayCommits

  6. TOOD: Task-Aware Out-of-Distribution Score Calibration for Continual Learners

    Jul 31, 2026Mostafa ElAraby, Samer B. Nashed, Liam PaullOut-Of-Distribution DetectionOut-Of-Distribution

  7. Execution-bound advisory automation for agentic AI: a reproducible AIBOM-driven CSAF-VEX framework

    Jun 16, 2026Petar Radanliev, Omar Santos, Carsten Maple +1Security EvaluationRuntime Enforcement

  8. DFAH-Bench: Benchmarking Observable Agent Instability in Financial Decision-Making

    Jun 10, 2026Raffi KhatchadourianDeterministic ReplayReproducibility

  9. Quantifying the Energy Floor: Direct Measurement and Replay Buffer Bias in SAC-Based HVAC Control on sbsim

    Jun 1, 2026Bo Li, Chen ZhangHvac ControlEnergy-Efficient

  10. Streaming Reinforcement Learning under Partial Observability with Real-Time Recurrent Learning

    May 23, 2026Noah Farr, Aryaman Reddi, Carlo D'Eramo +1Recurrent Neural NetworksDeterministic Replay

  11. Good to Go: The LOOP Skill Engine That Hits 99% Success and Slashes Token Usage by 99% via One-Shot Recording and Deterministic Replay

    May 14, 2026Xiaohua Wang, Kai Yu, XuXiao Liang +2Agent LoopDeterministic Replay

  12. When Does Non-Uniform Replay Matter in Reinforcement Learning?

    May 11, 2026Michal Korniak, Mikołaj Czarnecki, Yarden As +3Deterministic ReplayReplay

  13. Revisiting Adam for Streaming Reinforcement Learning

    May 7, 2026Florin Gogianu, Adrian Catalin Lutu, Razvan PascanuDeep Q-NetworksAdam

  14. Beyond the Independence Assumption: Finite-Sample Guarantees for Deep Q-Learning under ττ-Mixing

    May 7, 2026Leon Halgryn, Sophie Langer, Janusz M. Meylahn +1Deep Q-NetworksDeterministic Replay

  15. TSN-Affinity: Similarity-Driven Parameter Reuse for Continual Offline Reinforcement Learning

    Apr 28, 2026Dominik Żurek, Kamil Faber, Marcin Pietron +2Replay-Based Continual LearningModel-Based Reinforcement Learning

  16. Replay-buffer engineering for noise-aware quantum circuit optimization

    Apr 23, 2026Akash Kundu, Sebastian FeldQuantum CircuitsHybrid Quantum-Classical Pipeline

  17. Stateless Decision Memory for Enterprise AI Agents

    Apr 22, 2026Vasundra SrinivasanLong-Term Agent MemoryPersistent State

  18. VLM-Guided Experience Replay

    Feb 2, 2026Elad Sharony, Tom Jurgenson, Orr Krupnik +2Large Language Model Reinforcement LearningPrioritized Experience Replay

  19. Frictional Q-Learning

    Sep 24, 2025Hyunwoo Kim, Hyo Kyung LeeQ-LearningFriction

  20. Replicability is Asymptotically Free in Multi-armed Bandits

    Feb 12, 2024Junpei Komiyama, Shinji Ito, Yuichi Yoshida +1Stochastic Multi-Armed BanditsReproducibility

  21. Retriever: Composing the Perception-Reasoning-Action Loop for Long-Horizon Manipulation

    Date pendingLinfeng Zhao, Haojie Huang, Jiayuan Mao +3Agent LoopDeterministic Replay