2 papers in the last four weeks, with none the four weeks before. 0.0% of all new papers.
Oct 1, 2026·Kyungmin Lee, Sibeen Kim, Dongyoon Hwang +6Cross-Embodiment RetargetingDexterous Manipulation
KAIST AI · Holiday Robotics
Sep 16, 2026·Yizhuo Li, Jianhao Yan, Yun Luo +9Proximal Policy OptimizationCritic Learning
Shanghai Jiao Tong University · Shanghai AI Laboratory · Westlake University +4
Jul 26, 2026·Wenxuan Zhang, Yuhui Wang, Donggang Jia +5Agentic Reinforcement LearningCritic Learning
KAUST
Jun 10, 2026·Mehmet Turan YardımcıHumanoid Loco-ManipulationRobotic Manipulation Policies
Department of Computer Engineering C¸ukurova University Adana, Türkiye
Jun 4, 2026·Muhammad Talha Sharif, Abdul RehmanMathematical ReasoningLLM Reasoning Strategies
dept. of Computer Science · National University of Computer and Emerging Sciences · Islamabad, Pakistan
Jun 3, 2026·Shree Murthy, Rohan PandeyMulti-Agent Reinforcement LearningDynamic Pricing
DigitalOcean, USA
May 26, 2026·Dhruv S. Kushwaha, Zoleikha A. BironControl Barrier FunctionsSoft Actor-Critic
May 23, 2026·Safwan Labbi, Paul Mangold, Daniil Tiapkin +1Entropy Regularized Reinforcement LearningSoft Actor-Critic
CMAP, CNRS, École Polytechnique, Institut Polytechnique de Paris, 91120 Palaiseau, France · Université Paris-Saclay, CNRS, LMO, 91405, Orsay, France · Google DeepMind +2
May 20, 2026·Austin Braniff, Yuhe TianChemical Process SystemsModel Predictive Control
Department of Chemical and Biomedical Engineering, West Virginia University, Morgantown, WV 26506 USA
May 18, 2026·Mahesh Bhosale, Abdul Wasi, Vishvesh Trivedi +3Long Video Question AnsweringKeyframe Selection
University at Buffalo · 2New York University
May 5, 2026·Yu-Ting Lee, Samuel Yen-Chi Chen, Fu-Chieh ChangVariational Quantum CircuitsHierarchical Reinforcement Learning
Graduate Institute of Communication Engineering, National Taiwan University, Taipei, Taiwan · Wells Fargo, New York, NY, USA · MediaTek Inc., Hsinchu, Taiwan
Apr 22, 2026·Zeyu Shen, Peter HendersonMixture-Of-ExpertsCritic Learning
1Princeton University
Apr 21, 2026·Yuan Zhuang, Yuexin Bian, Sihong He +7Critic LearningOff-Policy Learning
University of Connecticut · University of California San Diego · University of Texas at Arlington +1
Jan 26, 2026·Shaokang Wang, Pei Fu, Ruoceng Zhang +7Graphical User Interface AgentsCritic Learning
MiLM Plus, Xiaomi Inc, Beijing, China · School of Computer Science, Peking University, Beijing, China
Jun 8, 2025·Yang Xu, Swetha Ganesh, Vaneet AggarwalQ-LearningSoft Actor-Critic
Purdue University, West Lafayette, Indiana, USA 47907
Nov 4, 2020·Anand Kamat, Doina PrecupCritic LearningReward Functions
McGill University · Mila · 3Google deepmind