Off-Policy Evaluation

Momentum

8 papers in the last four weeks, up 167% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 46

All topics
CardsList
  1. Offline Contextual Bandits in the Presence of New Actions

    May 18, 2026Ren Kishimoto, Tatsuhiro Shimizu, Kazuki Kawamura +6Off-Policy EvaluationPolicy Optimization

  2. Behavior-Induced Mirror-Prox Temporal-Difference Learning for Faster Off-Policy Prediction

    May 16, 2026Xingguo Chen, Yuchen Shen, Shangdong Yang +3Off-Policy EvaluationTemporal-Difference Learning

  3. From Static Risk to Dynamic Trajectories: Toward World-Model-Inspired Clinical Prediction

    May 16, 2026Pujun Feng, Xiaoyu Guo, Seyed Ehsan Saffari +10Causal Effect EstimationOff-Policy Evaluation

  4. Logging Policy Design for Off-Policy Evaluation

    May 14, 2026Connor Douglas, Joel Persson, Foster ProvostOff-Policy EvaluationPolicy Optimization

  5. Decision Support for Marketplace Policies under Incomplete Evidence: From Replay to Launch Readiness

    May 13, 2026Prashant Shekhar, Caroline HowardAI-Assisted Decision MakingOff-Policy Evaluation

  6. Model-based Bootstrap of Controlled Markov Chains

    May 12, 2026Ziwei Su, Imon Banerjee, Diego KlabjanMarkov Decision ProcessesOff-Policy Evaluation

  7. Controllable User Simulation

    May 12, 2026Guy Tennenholtz, Ofer Meshi, Amir Globerson +3Off-Policy EvaluationCausal Inference

  8. Offline Policy Evaluation for Manipulation Policies via Discounted Liveness Formulation

    May 12, 2026Hao Wang, Joshua Bowden, Colton Crosby +1RL for RoboticsReinforcement Learning

  9. SOPE: Stabilizing Off-Policy Evaluation for Online RL with Prior Data

    May 7, 2026Carlo Romeo, Girolamo Macaluso, Alessandro Sestini +1Off-Policy EvaluationOffline-To-Online RL

  10. Robustness of Refugee-Matching Gains to Off-Policy Evaluation Choices

    Apr 25, 2026Kirk Bansak, Elisabeth Paulson, Dominik Rothenhäusler +3Counterfactual EvaluationCausal Effect Estimation

  11. Distributional Off-Policy Evaluation with Deep Quantile Process Regression

    Apr 20, 2026Qi Kuang, Chao Wang, Yuling Jiao +1Distributional RLQuantile Regression

  12. Fitted Q-Evaluation without Bellman Completeness via Occupancy Weighting

    Dec 29, 2025Lars van der Laan, Nathan KallusOff-Policy EvaluationValue Function Estimation

  13. PERRY: Policy Evaluation with Confidence Intervals using Auxiliary Data

    Jul 26, 2025Aishwarya Mandyam, Jason Meng, Ge Gao +4Off-Policy EvaluationHealthcare