Policy Iteration

Latest papers 13

All topics
CardsList
  1. Policy Iteration Is Not Strongly Polynomial for Deterministic Markov Decision Processes: The Price of Algorithmic Anarchy

    Sep 30, 2026Han Zhong, Yinyu YeMarkov Decision ProcessesPolicy Iteration

  2. Learning to Solve Stochastic Controls with Unknown Drifts and Running Rewards: Theory, Algorithms and Convergence

    Sep 14, 2026Jin Ma, Gaozhan Wang, Jianfeng Zhang +1Reinforcement LearningStochastic Optimal Control

  3. Exact Model-Free Policy Iteration for Co-safe LTL Planning

    Aug 5, 2026Zetong Xuan, Yu WangReinforcement LearningPolicy Iteration

  4. Convergence of Monte Carlo Optimistic Policy Iteration: Beyond Uniform State-Action Updates

    Jun 9, 2026Octave Oliviers, Glenn VinnicombeMarkov Decision ProcessesReinforcement Learning

  5. Natural Policy Gradient as Doubly Smoothed Policy Iteration: A Bellman-Operator Framework

    May 11, 2026Phalguni Nanda, Zaiwei ChenPolicy GradientReinforcement Learning

  6. Approximate Next Policy Sampling: Replacing Conservative Target Policy Updates in Deep RL

    May 6, 2026Dillon Sandhu, Ronald ParrPolicy OptimizationPolicy Iteration

  7. Continuous Policy and Value Iteration for Stochastic Control Problems and Its Convergence

    Jun 9, 2025Qi Feng, Gu WangStochastic Optimal ControlPolicy Iteration

  8. Gaussian process policy iteration with additive Schwarz acceleration for forward and inverse HJB and mean field game problems

    May 1, 2025Xianjin Yang, Jingguo ZhangMean Field GamesStochastic Optimal Control

  9. Bridging the Gap between Newton-Raphson Method and Regularized Policy Iteration

    Oct 11, 2023Zeyang Li, Chuxiong Hu, Yunan Wang +4Markov Decision ProcessesReinforcement Learning

  10. Monotone Neural Policy Iteration for High-Dimensional First-Order Hamilton--Jacobi--Bellman Equations

    Date pendingMinseok Kim, Yeongjong Kim, Namkyeong Cho +1Neural PDE SolversStochastic Optimal Control