Experience Replay

Momentum

9 papers in the last four weeks, against 1 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 28

All topics
CardsList
  1. EVISKILL: Grounding Skill Evolution in Replayable Evidence

    Oct 4, 2026Yan Zhou, Yili Wang, Yiwei Dai +2Continual Learning for LLM AgentsExperience Replay

  2. Reusing Past Samples in Proximal Policy Optimization: When and How Does It Help?

    Oct 1, 2026Alessandro Montenegro, Riccardo Venturelli, Marco Mussi +2Experience ReplayProximal Policy Optimization

  3. ER-JEPA: Experience Replay Improves Joint-Embedding Predictive Learning in Language Models

    Sep 29, 2026Jingnan Pu, Zi-En Fan, Feng LianMemory-Augmented Language ModelsJoint-Embedding Predictive Architecture

  4. ReplayLens: Auditing Agents' Use of Outcomes

    Sep 28, 2026Dong Xu, Zhangfan Yang, Jiantao Wu +5AI Agent AuditingLLM Agent Memory

  5. Reliable Replay through Spatial Coherence in Online Continual Learning

    Sep 27, 2026Haixiang Sun, Jiefu Zhang, Yinghao He +4Continual Learning for LLMsExperience Replay

  6. CORTEX: A Verified Experience Layer for Generalist Agents

    Sep 27, 2026Garapati Keerthana, Manik GuptaAI Agent ReliabilityLifelong Learning Agents

  7. On Preference Coverage Collapse from Hindsight Relabeling in Multi-Objective Reinforcement Learning

    Sep 22, 2026Baptiste Bonin, Caro Strickland, Audrey DurandMulti-Objective Reinforcement LearningExperience Replay

  8. Characterizing Replay Retention Under Dynamics Shift in Model-Based Reinforcement Learning

    Sep 16, 2026Everest Yang, Skye Thompson, George D. KonidarisNon-Stationary RLContinual Robot Learning

  9. Anchoring What Matters: A Dual-Level Learning Framework for Visually-Grounded Multimodal Reasoning

    Sep 16, 2026Xinxin Song, Siyuan Li, Tingxiong Xiao +1Credit Assignment in RLExperience Replay

  10. Headroom-Drift Replay: A Primitive for Principled Replay Control in GRPO

    Sep 3, 2026Hyun Bin Park, Du-Seong ChangRL for Language Model ReasoningGroup Relative Policy Optimization

  11. Beyond Isolation: Unlocking Reinforcement Learning Component Synergy for Sample-Efficient Continuous Control

    Aug 7, 2026Qi Zhao, Guozheng Ma, Yilun Kong +9Reinforcement LearningExperience Replay

  12. Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning

    Jul 27, 2026Parham Mohammad Panahi, Armin Ashrafi, Haoyu Du +3Deep Q-LearningExperience Replay

  13. Rethinking Transfer in Continual Learning: A Replay-Based Realisation

    Jul 17, 2026Yang Meng, Zhenya Liu, Zhuokai Zhao +1Continual Learning for LLMsExperience Replay

  14. Replay What Matters: Off-Policy Replay for Efficient LLM Reinforcement Unlearning

    Jun 13, 2026Zirui Pang, Chenlong Zhang, Haosheng Tan +3Experience ReplayMachine Unlearning

  15. Focus, Align, and Sustain: Counteracting Gradient Dilution in Incremental Object Detection

    Jun 13, 2026Aoting Zhang, Dongbao Yang, Chang Liu +2Class-Incremental LearningDetection Transformer

  16. Rollout-Level Advantage-Prioritized Experience Replay for GRPO

    Jun 3, 2026Gyeongtae Yoo, Sanghyeok Park, Soohyuk Jang +2RL for Language Model ReasoningGroup Relative Policy Optimization

  17. When Does Non-Uniform Replay Matter in Reinforcement Learning?

    May 11, 2026Michal Korniak, Mikołaj Czarnecki, Yarden As +3Experience ReplaySample-Efficient RL

  18. From Passive Reuse to Active Reasoning: Grounding Large Language Models for Neuro-Symbolic Experience Replay

    May 10, 2026Yanan Xiao, Yixiang Tang, Zechen Feng +3Reinforcement LearningExperience Replay

  19. Experience Constrained Hierarchical Federated Reinforcement Learning for Large-scale UAV Teams in Hazardous Environments

    May 4, 2026Qinwei Huang, Rui Zuo, Simon Khan +1Hierarchical Federated LearningFederated RL

  20. Data Deletion Can Help in Adaptive RL

    Apr 30, 2026Param Budhraja, Aditya Gangrade, Alex Olshevsky +1Non-Stationary RLReinforcement Learning

  21. E2^2DT: Efficient and Effective Decision Transformer with Experience-Aware Sampling for Robotic Manipulation

    Apr 30, 2026Kaiyan Zhao, Borong Zhang, Yiming Wang +4Long-Horizon Robotic ManipulationTransformer

  22. Replay-buffer engineering for noise-aware quantum circuit optimization

    Apr 23, 2026Akash Kundu, Sebastian FeldReinforcement LearningExperience Replay

  23. Leveraging Complementary Embeddings for Replay Selection in Continual Learning with Small Buffers

    Apr 9, 2026Danit Yanowsky, Daphna WeinshallExperience ReplayReplay-Based Continual Learning

  24. CONTHER: Context-Aware Reinforcement Learning for Robotic Manipulation with Sparse Rewards

    Mar 20, 2025Maria Makarova, Qian Liu, Dzmitry TsetserukouReinforcement LearningExperience Replay

  25. Efficient Diversity-based Experience Replay for Deep Reinforcement Learning

    Oct 27, 2024Kaiyan Zhao, Yiming Wang, Yuyang Chen +3Experience ReplayDeterminantal Point Process

  26. ETHER: Aligning Emergent Communication for Hindsight Experience Replay

    Jul 28, 2023Kevin Yandoka Denamganaï, Daniel Hernandez, Ozan Vardal +2Reinforcement LearningExperience Replay