Temporal-Difference Learning

Momentum

9 papers in the last four weeks, up 200% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 57

All topics
CardsList
  1. λλ-Reachability: Geometric-Horizon Safety Bellman Equations for Humanoid Safety

    Jun 14, 2026Rui Chen, Shangtao Li, Yifan Sun +1Reachability AnalysisTemporal-Difference Learning

  2. Fast and Robust Convergence Rate for TD(0) with Linear Function Approximation, Universal Learning Steps and I.I.D. Samples

    Jun 4, 2026Ziad Kobeissi, Éloïse BerthierStochastic ApproximationTemporal-Difference Learning

  3. Trace-Mediated Peak Bias: Bridging Temporal Credit Assignment and Cognitive Heuristics in Deep Reinforcement Learning

    Jun 3, 2026Viktor Veselý, Aleksandar Todorov, Erwan Escudie +1Temporal Credit AssignmentTemporal-Difference Learning

  4. Convergence of Two-Timescale Markovian Stochastic Approximations with Applications in Reinforcement Learning

    May 29, 2026Vagul Mahadevan, Claire Chen, Shuze Daniel Liu +1Stochastic ApproximationTemporal-Difference Learning

  5. Behavior-Aware Auxiliary Corrections for Off-Policy Temporal-Difference Prediction

    May 17, 2026Xingguo Chen, Zhiang He, Yuchen Shen +4Temporal-Difference LearningLinear Function Approximation

  6. Behavior-Induced Mirror-Prox Temporal-Difference Learning for Faster Off-Policy Prediction

    May 16, 2026Xingguo Chen, Yuchen Shen, Shangdong Yang +3Off-Policy EvaluationTemporal-Difference Learning

  7. Adaptive TD-Lambda for Cooperative Multi-agent Reinforcement Learning

    May 12, 2026Yue Deng, Zirui Wang, Yin ZhangTemporal-Difference LearningDensity Ratio Estimation

  8. Quotient-Categorical Representations for Bellman-Compatible Average-Reward Distributional Reinforcement Learning

    May 11, 2026Ege C. Kaya, Aliasghar Pourghani, Vijay Gupta +1Distributional RLReinforcement Learning

  9. MemQ: Integrating Q-Learning into Self-Evolving Memory Agents over Provenance DAGs

    May 8, 2026Junwei Liao, Haoting Shi, Ruiwen Zhou +9LLM Agent MemoryQ-Learning

  10. Beyond Linear Attention: Softmax Transformers Implement In-Context Reinforcement Learning

    May 8, 2026Zixuan Xie, Xinyu Liu, Claire Chen +3Reinforcement LearningTransformer-Based RL

  11. On the Divergence of Differential Temporal Difference Learning without Local Clocks

    May 7, 2026David Antrobius, Shangtong ZhangReinforcement LearningAverage-Reward RL

  12. A Sharp Finite-Iteration Theory for Asynchronous Categorical Distributional Temporal-Difference Learning

    May 7, 2026Ege C. Kaya, Abolfazl HashemiDistributional RLReinforcement Learning

  13. Beyond the Independence Assumption: Finite-Sample Guarantees for Deep Q-Learning under ττ-Mixing

    May 7, 2026Leon Halgryn, Sophie Langer, Janusz M. Meylahn +1Reinforcement LearningDeep Q-Learning

  14. AdaGamma: State-Dependent Discounting for Temporal Adaptation in Reinforcement Learning

    May 7, 2026Yaomin Wang, Jianting Pan, Ran Tian +4Reinforcement LearningTemporal-Difference Learning

  15. Long-Horizon Q-Learning: Accurate Value Learning via n-Step Inequalities

    May 7, 2026Armaan A. Abraham, Lucy Xiaoyang Shi, Chelsea FinnQ-LearningTemporal-Difference Learning

  16. Extending Differential Temporal Difference Methods for Episodic Problems

    May 6, 2026Kris De Asis, Mohamed Elsayed, Jiamin HeReinforcement LearningTemporal-Difference Learning

  17. Bridging the Gap Between Average and Discounted TD Learning

    May 3, 2026Haoxing Tian, Zaiwei Chen, Ioannis Ch. Paschalidis +1Reinforcement LearningAverage-Reward RL

  18. AdamO: A Collapse-Suppressed Optimizer for Offline RL

    May 3, 2026Nan Qiao, Sheng Yue, Shuning Wang +1Reinforcement LearningTemporal-Difference Learning

  19. Regularized Centered Emphatic Temporal Difference Learning

    May 2, 2026Xingguo Chen, Chaohui Wu, Jinguo Ye +5Temporal-Difference Learning

  20. Bayesian policy gradient and actor-critic algorithms

    Apr 30, 2026Mohammad Ghavamzadeh, Yaakov Engel, Michal ValkoBayesian RLTemporal-Difference Learning

  21. Intentional Updates for Streaming Reinforcement Learning

    Apr 21, 2026Arsalan Sharifnassab, Mohamed Elsayed, Kris De Asis +2Reinforcement LearningTemporal-Difference Learning

  22. Reinforcement Learning in Switching Non-Stationary Markov Decision Processes: Algorithms and Convergence Analysis

    Mar 24, 2025Mohsen Amiri, Sindri MagnússonNon-Stationary RLMarkov Decision Processes

  23. Statistical Inference for Policy Evaluation with Temporal Difference Learning

    Oct 21, 2024Weichen Wu, Gen Li, Yuting Wei +1Parameter EstimationConfidence Region Estimation