Replay

Momentum

13 papers in the last four weeks, up 44% on the four weeks before. 0.2% of all new papers.

Jul 6Week of Sep 21

Latest papers 89

All topics
CardsList
  1. Auditing Action Settlement in LLM Agent Environments: Order, Progress, and Replay

    Oct 1, 2026Haotian Chen, Bowen Ye, Yuning Zhang +1Large Language Model AgentsContracts

  2. Replay on Demand: An Emergent Curriculum for Balancing Adaptation and Forgetting in Continued Pretraining

    Sep 30, 2026Lukas Thede, Shengzhuang Chen, Stefan Winzeck +3ReplayPretraining

  3. Forking: Sudden Overfitting Under Replay

    Sep 30, 2026Shanbin Yu, Shaoyang Guo, Haoran Zhao +2OverfittingCatastrophic Forgetting

  4. Can Computation from Earlier Problems Help LLMs Solve New Ones?

    Sep 30, 2026Jipei He, Wenhui Tan, Xiaoyi Yu +4LLM Reasoning StrategiesReplay

  5. FAER: Auditable Utility-Aligned Trajectory Replay for Language Model Post-Training

    Sep 30, 2026Miaobo Hu, Shuhao Hu, Xiaobo Guo +5ReplayResponses

  6. VStress: Correlation-Aware Auditing and Adaptive Budget Allocation for Repeated Verifiers

    Sep 29, 2026Miaobo Hu, Shuhao Hu, Xiaobo Guo +5Verification FrameworkStress Testing

  7. ReplayLens: Auditing Agents' Use of Outcomes

    Sep 28, 2026Dong Xu, Zhangfan Yang, Jiantao Wu +5ReplayInteraction History

  8. Reliable Replay through Spatial Coherence in Online Continual Learning

    Sep 27, 2026Haixiang Sun, Jiefu Zhang, Yinghao He +4Prioritized Experience ReplayReplay-Based Continual Learning

  9. Just Let Linear States Forget the Distant Past: Prefix Caching via Suffix Replay for Hybrid LLMs

    Sep 27, 2026Yirui Liu, Ruoling Qi, Xuaner Wu +6Kimi Delta AttentionCache

  10. ProgramDistill: From Interactive Web Apps to Verifiable Reference-Guided SWE Tasks

    Sep 16, 2026Jeonghye Kim, Minseon Kim, Young Jin Kim +5Coding AgentsSoftware Engineering

  11. VRL-Bench: Benchmarking agents on computer control tasks under finite trial budgets

    Sep 14, 2026Yu Bai, Yukai Miao, Dawei Wang +8Offline Reinforcement LearningStochastic Exploration

  12. Improving 5G AI-RAN MCS Selection by Predicting Retransmissions

    Sep 10, 2026Tamerlan Aghayev, Maxime Elkael, Michele Polese +5Open Radio Access NetworksHip-Lora

  13. Headroom-Drift Replay: A Primitive for Principled Replay Control in GRPO

    Sep 3, 2026Hyun Bin Park, Du-Seong ChangReplayAgentic Search

  14. DNative-Twin: Decision Graphs and Digital Twins for Reconstructable Agentic Decisions

    Sep 3, 2026Junjie Pang, Zhenzhen Xie, Haoke Han +3Digital TwinsTwins

  15. Tail-Replay: Escaping the Curse of Linear Attention in Prefix Caching for Hybrid LLMs

    Aug 31, 2026Yirui Liu, Ruoling Qi, Xuaner Wu +2Kimi Delta AttentionLinear Attention

  16. GramLoop: Training-Free Gram-Gated Replay for Robust Dense Prediction

    Aug 29, 2026Yang Chen, Canyu Shen, Xinzhe Rao +5Dense PredictionDinov3

  17. IADD-TR: Intervention-Aware Dynamics Decoupling with Targeted Regularization for Model-Based Reinforcement Learning

    Aug 11, 2026Zefeng Liang, Jie Qiao, Ruichu Cai +2Model-Based Reinforcement LearningRegularization

  18. Identifying potentiating events in evolutionary search using replay experiments

    Aug 10, 2026Austin J. Ferguson, Alexander LalejiniEvolutionary OptimizationEvolutionary Search

  19. Agentic Reinforcement Learning with Observation-Calibrated Self-Distillation

    Aug 5, 2026Yi Yang, Cong Qin, Xiaodan Liu +8Unsupervised On-Policy Self-DistillationSelf-Distillation Framework

  20. Diagnose Before You Compress: Prediction-Independent Bottleneck Witness Refinement for LLM Serving Traces

    Aug 1, 2026Liming Liu, Chao Hu, Mingfei Lu +7Large Language Model ServingWorkload

  21. MemHarness: Memory Is Reconstructed, Not Replayed

    Jul 30, 2026Rong Wu, Daocheng Fu, Licheng Wen +10Large Language Model AgentsReplay

  22. Dynamic Parameterization Is Not Dynamic Inference

    Jul 28, 2026Zongfei Li, Yuan-yih Shang, Guozhong LuoInference DynamicsReplay

  23. Endpoint Replay: Compressing the Recency Buffer in Deep Reinforcement Learning

    Jul 27, 2026Parham Mohammad Panahi, Armin Ashrafi, Haoyu Du +3Replay

  24. REGEN: Replay-recycling for Expert-to-Generalist distillation with Offline Reinforcement Learning

    Jul 21, 2026Yunjie Chen, Xiaoxin Chen, Fang WangMulti-Turn Reinforcement LearningOffline Reinforcement Learning

  25. Rethinking Transfer in Continual Learning: A Replay-Based Realisation

    Jul 17, 2026Yang Meng, Zhenya Liu, Zhuokai Zhao +1Replay-Based Continual LearningContinual Learning

  26. Hindcast: Replaying Prediction Markets to Evaluate LLM Forecasters

    Jul 15, 2026Xiao Ye, Jacob Dineen, Evan Zhu +3Large Language Model ForecastingForesight

  27. An Empirical Study for Android-to-OpenHarmony GUI Test Migration

    Jul 13, 2026Yakun Zhang, Xinjia Chen, Yiyun Chen +6DeviceEmpirical Study

  28. REDDIT: Forgetting-Resistant Correction of Timestamp Drift in ASR via Replay-Based Distribution Editing

    Jul 6, 2026Cheng-Kang Chou, Ming-To Chuang, Ke-Han Lu +2Automatic Speech RecognitionDense Temporal Annotation

  29. Are Performance-Optimization Benchmarks Reliably Measuring Coding Agents?

    Jul 1, 2026Zhi Chen, Zhensu Sun, Yuling Shi +2Swe-Bench VerifiedCoding Agents

  30. COHORT: Collaborative Orchestration for Hardening via Offensive Replay on Emulated Topologies

    Jun 29, 2026Chen Frydman, Aviram Zilberman, Rubin Krief +6MitigationOrchestration

  31. Position Rebinding Cache Reuse: Replay-Free Visual Revisiting for Interleaved Multimodal Reasoning

    Jun 25, 2026Mengzhao Wang, Yanli Ji, Wangmeng Zuo +2Multimodal ReasoningMultimodal Reasoning Benchmarks

  32. OVIG: Optimistic Verification of AI Training Integrity via Gradient Signals

    Jun 19, 2026Hongxu Su, Jianzhu Yao, Huan Zhang +2Artificial Intelligence SystemsReplay

  33. SEAGym: An Evaluation Environment for Self-Evolving LLM Agents

    Jun 16, 2026Congjie Zheng, Chuanyi Xue, Bin Liang +2Self-Evolving AgentsAgent Harness

  34. Continual Online Personalization of Exoskeleton Control via Manifold-Aware Experience Replay

    Jun 16, 2026Changseob Song, Inseung KangExoskeletonGait Dynamics

  35. Replay What Matters: Off-Policy Replay for Efficient LLM Reinforcement Unlearning

    Jun 13, 2026Zirui Pang, Chenlong Zhang, Haosheng Tan +3Large Language Model UnlearningLarge Language Model Reinforcement Learning

  36. GitOfThoughts: Version-Controlled Reasoning and Agent Memory You Can Replay, Diff, and Merge

    Jun 12, 2026Pavan C Shekar, Abhishek H S, Aswanth KrishnanReplay

  37. Echo-Memory: A Controlled Study of Memory in Action World Models

    Jun 8, 2026Wayne King, Zeyue Xue, Yuxuan Bian +13ReplayWorld Models

  38. One Lens, Many Worlds : A Capability-Typed Interface for World-Model Interpretability

    Jun 7, 2026Bhavith Chandra Challagundla, Sanskar Pandey, Param Thakkar +7World ModelsMany Worlds

  39. Rollout-Level Advantage-Prioritized Experience Replay for GRPO

    Jun 3, 2026Gyeongtae Yoo, Sanghyeok Park, Soohyuk Jang +2Parallel RolloutsReplay