Contrastive RL

RL: Reinforcement Learning

Momentum

1 paper in the last four weeks, against 2 the four weeks before. 0.0% of all new papers.

Jul 13Week of Sep 28

Latest papers 18

All topics
CardsList
  1. Direction-Conditioned Policies for Online Goal-Conditioned Reinforcement Learning

    Oct 4, 2026S K Swaminathan, Damiya Gondha, Theyanesh Eswaramoorthy Rajahkrishnan +1Reinforcement LearningContrastive RL

  2. Learning to Zoom Efficiently with a Contrastive Curriculum

    Sep 2, 2026Falko Helm, Iryna GurevychTool Use in VLMsContrastive RL

  3. Three Steps at a Time: Learning Representations from Action Sequences in Contrastive RL

    Aug 31, 2026Michal Korniak, Kamil Dybek, Benjamin Eysenbach +2Reinforcement LearningOffline RL

  4. RRPO: Reference-Relative Policy Optimization with Stratified Conditional Rollouts

    Jul 20, 2026Yuxin Xiong, Xunyi Jiang, Rohan Surana +8Reinforcement LearningRL for Language Model Reasoning

  5. GCT-MARL: Graph-Based Contrastive Transfer for Sample-Efficient Cooperative Multi-Agent Reinforcement Learning

    Jun 23, 2026Animesh Animesh, Satheesh K Perepu, Kaushik DeyGraph Contrastive LearningContrastive RL

  6. Context-Aware RL for Agentic and Multimodal LLMs

    Jun 15, 2026Peiyang Xu, Bangzheng Li, Sijia Liu +4Multimodal GroundingContrastive RL

  7. Direction-Conditioned Policies via Compositional Subgoal Scoring for Online Goal-Conditioned Reinforcement Learning

    Jun 15, 2026Swaminathan S K, Damiya Gondha, Theyanesh Eswaramoorthy Rajahkrishnan +1Contrastive RLPolicy Learning

  8. Learning Object Manipulation from Scratch via Contrastive Interaction

    Jun 10, 2026Tongle Shen, Caleb Chuck, Fan Feng +1Dynamical SystemsReinforcement Learning

  9. Harmony in Diversity: Multi-domain Contrastive Policy Optimization for Large Reasoning Models

    May 25, 2026Zongji Yu, Wenshui Luo, Yiliu Sun +5Reinforcement LearningRL for Language Model Reasoning

  10. Self-Supervised On-Policy Reinforcement Learning via Contrastive Proximal Policy Optimisation

    May 13, 2026Asim Osman, Sasha Abramowitz, Mark Bergh +13Reinforcement LearningContrastive RL

  11. Revisiting Reinforcement Learning with Verifiable Rewards from a Contrastive Perspective

    May 13, 2026Feng Zhang, Xinhong Ma, Ziqiang Dong +5RL for Language Model ReasoningGroup Relative Policy Optimization

  12. From Generic Correlation to Input-Specific Credit in On-Policy Self Distillation

    May 12, 2026Guobin Shen, Lei Huang, Xiang Cheng +4Reinforcement LearningOn-Policy Self-Distillation

  13. PRTS: A Primitive Reasoning and Tasking System via Contrastive Representations

    Apr 30, 2026Yang Zhang, Jiangyuan Zhao, Chenyou Fan +11Reinforcement LearningLong-Horizon Robotic Manipulation

  14. 1000 Layer Networks for Self-Supervised RL: Scaling Depth Can Enable New Goal-Reaching Capabilities

    Mar 19, 2025Kevin Wang, Ishaan Javali, Michał Bortkiewicz +2Reinforcement LearningRobotic RL