Temporal Difference

Latest papers 41

All topics
CardsList
  1. Temporal-Difference Learning for Dragonchess

    Oct 1, 2026Jim O'Connor, Annika Hoag, Sarah Goyette +1ChessTemporal Difference

  2. Fast Regularized Policy Mirror Descent with One-Step TD Updates

    Sep 30, 2026Qipei Chen, Wenye Li, Yule Sun +1Mirror DescentTemporal Difference

  3. Sharp Statistical Rates for Asynchronous TD Learning with Markovian Data

    Sep 30, 2026Yang PengTemporal DifferenceMarkov

  4. GTRL: Grounding Divide-and-Conquer Value Learning with Temporal Differences

    Sep 27, 2026Abdul Monaf Chowdhury, MD Sameer Iqbal Chowdhury, Shifat E Arman +1Goal-Conditioned Reinforcement LearningTemporal Difference

  5. A Contraction Framework for Stochastic Operators with Bootstrapping: Application to TD Learning

    Sep 24, 2026Ids van der Werf, Sergio Rozada, Antonio G. MarquesStochastic ApproximationTemporal Difference

  6. CARE-VI: Conservative Adaptive Reliability Estimation for Value Improvement in Off-Policy Actor-Critic Learning

    Sep 17, 2026Xiang Zou, Shengzhu Shi, Junqi Gao +1Soft Actor-CriticTemporal Difference

  7. A Finite-Sample Analysis of Quantile Temporal-Difference Learning

    Aug 27, 2026Zijie Cheng, Xiang Li, Yang Peng +1Temporal DifferenceConvergence

  8. Online Inference for Quantile Temporal Difference Learning in Distributional Reinforcement Learning

    Aug 13, 2026Zijie Cheng, Yang Peng, Zhihua ZhangDistributional Reinforcement LearningTemporal Difference

  9. Self-Normalized Inference for Constant-Stepsize Temporal-Difference Learning under Markovian Sampling

    Aug 11, 2026Min Zeng, Yichen Zhang, Xiaofeng ShaoTemporal DifferenceLarge Deviation Principle

  10. Gated-BEPO: Confidence-Gated Bellman Credit Assignment for Large Language Model Agents

    Aug 7, 2026Hongxi Yan, Ziyue Huang, Shichao Fan +1Credit AssignmentLarge Language Model Agents

  11. Visual Representation Matters: Exploiting Temporal Differences in Video-to-Audio Generation

    Aug 5, 2026Zehua Chen, Junyou Wang, Yuxuan Jiang +5Audio-Video GenerationText-To-Video Diffusion Models

  12. Revisiting TD Target Aggregation under Uncertainty in Q-Learning

    Aug 4, 2026Lipeng Zu, Xiaonan ZhangDeep Q-NetworksQ-Learning

  13. Generalized Kalman filter based temporal difference reinforcement learning

    Jul 22, 2026Vasos Arnaoutis, Eric Lutters, Bojana RosićTemporal DifferenceExtended Kalman Filter

  14. Non-Convex Sparse Reinforcement Learning via Non-Monotone Inclusions

    Jul 6, 2026Kyohei Suzuki, Konstantinos SlavakisEntropy Regularized Reinforcement LearningLipschitz Continuity

  15. Mesh-RL: Coupled subgrid reinforcement learning

    Jun 24, 2026Behnam Gheshlaghi, Bahador Rashidi, Shahin AtakishiyevTemporal DifferenceQ-Learning

  16. A Single Stepsize Suffices for Unprojected Linear TD(0): Simultaneous Robust and Fast Rates via Polyak--Ruppert Averaging

    Jun 23, 2026Wei-Cheng Lee, Francesco OrabonaStep AccuracyTemporal Difference

  17. On the Variance of Temporal Difference Learning and its Reduction Using Control Variates

    Jun 18, 2026Hsiao-Ru Pan, Bernhard SchölkopfTemporal DifferenceVariance Reduction

  18. A Diffusion Approximation for Temporal-Difference Learning with Linear Features under Markovian Noise

    Jun 16, 2026M. Forzo, E. Monzio Compagnoni, A. Russo +1Temporal DifferenceStochastic Differential Equations

  19. Temporal Difference Learning for Diffusion Models

    Jun 13, 2026Qizhen Ying, Yangchen Pan, Victor Adrian Prisacariu +1Denoising TrajectoryGenerative Models

  20. QPILOTS: Efficient Test-Time Q-Steering for Flow Policies

    Jun 11, 2026Yifan Ruan, Chenyang Cao, Andreas Burger +7Flow PoliciesQ-Learning

  21. Fast and Robust Convergence Rate for TD(0) with Linear Function Approximation, Universal Learning Steps and I.I.D. Samples

    Jun 4, 2026Ziad Kobeissi, Éloïse BerthierTemporal DifferenceConvergence

  22. Convergence of Two-Timescale Markovian Stochastic Approximations with Applications in Reinforcement Learning

    May 29, 2026Vagul Mahadevan, Claire Chen, Shuze Daniel Liu +1Stochastic ApproximationTemporal Difference

  23. ST-SimDiff: Balancing Spatiotemporal Similarity and Difference for Efficient Video Understanding with MLLMs

    May 21, 2026Bingjun Luo, Tony Wang, Chaoqi Chen +1Fine-Grained Video UnderstandingVideo Understanding

  24. Guided Trajectory Optimization with Sparse Scaling for Test-Time Diffusion

    May 21, 2026Gang Dai, Yining Huang, Yiming Xia +2Diffusion ModelsTest-Time Scaling

  25. Behavior-Aware Auxiliary Corrections for Off-Policy Temporal-Difference Prediction

    May 17, 2026Xingguo Chen, Zhiang He, Yuchen Shen +4Temporal DifferenceOff-Policy Learning

  26. Behavior-Induced Mirror-Prox Temporal-Difference Learning for Faster Off-Policy Prediction

    May 16, 2026Xingguo Chen, Yuchen Shen, Shangdong Yang +3Temporal DifferenceMirror Descent

  27. The Benefits of Temporal Correlations: SGD Learns k-Juntas from Random Walks Efficiently

    May 11, 2026Elisabetta Cornacchia, Dan Mikulincer, Elchanan MosselStochastic Gradient DescentOptimal Sample Complexity

  28. Equivalence of Coarse and Fine-Grained Models for Learning with Distribution Shift

    May 7, 2026Adam R. Klivans, Shyamal Patel, Konstantinos Stavropoulos +1LearnabilityDistribution Shifts

  29. On the Divergence of Differential Temporal Difference Learning without Local Clocks

    May 7, 2026David Antrobius, Shangtong ZhangTemporal DifferenceClocks

  30. A Finite-Iteration Theory for Asynchronous Categorical Distributional Temporal-Difference Learning

    May 7, 2026Ege C. Kaya, Abolfazl HashemiTemporal DifferenceDistributional Reinforcement Learning

  31. Extending Differential Temporal Difference Methods for Episodic Problems

    May 6, 2026Kris De Asis, Mohamed Elsayed, Jiamin HeTemporal DifferenceEpisodic Memory

  32. Structural Equivalence and Learning Dynamics in Delayed MARL

    May 5, 2026Jules Sintes, Ana Bušić, Jiamin ZhuPartially Observable Markov Decision ProcessMulti-Agent Reinforcement Learning

  33. Bridging the Gap Between Average and Discounted TD Learning

    May 3, 2026Haoxing Tian, Zaiwei Chen, Ioannis Ch. Paschalidis +1Temporal DifferenceBellman Equation

  34. Regularized Centered Emphatic Temporal Difference Learning

    May 2, 2026Xingguo Chen, Chaohui Wu, Jinguo Ye +5Temporal DifferenceRegularization

  35. Temporal Difference Calibration in Sequential Tasks: Application to Vision-Language-Action Models

    Apr 22, 2026Shelly Francis-Meretzki, Mirco Mutti, Yaniv Romano +1Temporal DifferencePhotometric Supervision

  36. Learnability Window in Gated Recurrent Neural Networks

    Dec 5, 2025Lorenzo LiviRecurrent Neural NetworksLearnability

  37. Statistical Inference for Policy Evaluation with Temporal Difference Learning

    Oct 21, 2024Weichen Wu, Gen Li, Yuting Wei +1Temporal DifferenceValue Functions