Critic Learning

Momentum

2 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 16

All topics
CardsList
  1. Rethinking Critic Learning in PPO: Understanding and Mitigating Value Flattening

    Sep 16, 2026Yizhuo Li, Jianhao Yan, Yun Luo +9Proximal Policy OptimizationCritic Learning

  2. Critic Architecture Matters: Dual vs. Unified Critics for Humanoid Loco-Manipulation

    Jun 10, 2026Mehmet Turan YardımcıHumanoid Loco-ManipulationRobotic Manipulation Policies

  3. Critic-Guided Heterogeneous Multi-Agent Reasoning for Reliable Mathematical Problem Solving

    Jun 4, 2026Muhammad Talha Sharif, Abdul RehmanMathematical ReasoningLLM Reasoning Strategies

  4. Refined Analysis of Entropy-Regularized Actor-Critic

    May 23, 2026Safwan Labbi, Paul Mangold, Daniil Tiapkin +1Entropy Regularized Reinforcement LearningSoft Actor-Critic

  5. Reinforcement Learning-based Control via Y-wise Affine Neural Networks: Comparative Case Studies for Chemical Processes

    May 20, 2026Austin Braniff, Yuhe TianChemical Process SystemsModel Predictive Control

  6. CRAFT: Critic-Refined Adaptive Key-Frame Targeting for Multimodal Video Question Answering

    May 18, 2026Mahesh Bhosale, Abdul Wasi, Vishvesh Trivedi +3Long Video Question AnsweringKeyframe Selection

  7. Quantum Hierarchical Reinforcement Learning via Variational Quantum Circuits

    May 5, 2026Yu-Ting Lee, Samuel Yen-Chi Chen, Fu-Chieh ChangVariational Quantum CircuitsHierarchical Reinforcement Learning

  8. Temporally Extended Mixture-of-Experts Models

    Apr 22, 2026Zeyu Shen, Peter HendersonMixture-Of-ExpertsCritic Learning

  9. Low-Rank Adaptation for Critic Learning in Off-Policy Reinforcement Learning

    Apr 21, 2026Yuan Zhuang, Yuexin Bian, Sihong He +7Critic LearningOff-Policy Learning

  10. GAIA: A Data Flywheel System for Training GUI Test-Time Scaling Critic Models

    Jan 26, 2026Shaokang Wang, Pei Fu, Ruoceng Zhang +7Graphical User Interface AgentsCritic Learning

  11. Efficient Q-Learning and Actor-Critic Methods for Robust Average-Reward Reinforcement Learning

    Jun 8, 2025Yang Xu, Swetha Ganesh, Vaneet AggarwalQ-LearningSoft Actor-Critic

  12. Diversity-Enriched Option-Critic

    Nov 4, 2020Anand Kamat, Doina PrecupCritic LearningReward Functions