Group Relative Policy Optimization

Recent momentum

-15%

22 papers in the last 28 days · 0.4% of indexed attention

Twelve weeks of publication activity for this topic as it is defined today.

Weekly history

Recent digests

What was published in this topic, kept on the site without email delivery.

Period ending 2026-09-21

6 new papers

A weekly snapshot of new work published in Group Relative Policy Optimization.

Period ending 2026-09-07

12 new papers

A weekly snapshot of new work published in Group Relative Policy Optimization.

287 papers

Latest in Group Relative Policy Optimization

  1. Reinforcement Learning with Decomposed Subtasks

    Sep 22, 2026Mattie Terzolo, Mikolaj Sacha, Ayan Sinha +1Group Relative Policy Optimization

  2. Spurious Advantage Hidden in GRPO

    Sep 3, 2026Jiamian Wang, Samyadeep Basu, Koustava Goswami +2Group Relative Policy OptimizationAdvantage

  3. Group Adaptive Clipping Policy Optimization

    Aug 31, 2026Sheng Jia, Xiao Wang, Shiva Prasad Kasiviswanathan +1Group Relative Policy OptimizationGradient Clipping