209 papers in the last four weeks, up 61% on the four weeks before. 1.4% of all new papers.
Apr 22, 2026·Mirazul Haque, Antony Papadimitriou, Samuel Mensah +6Quantitative FinanceDeep Research Agents
AI Research, JPMorganChase
Apr 22, 2026·Shivani Kumar, Adarsh Bharathwaj, David JurgensMulti-Agent LLM SystemsAI for Science
University of Michigan
Apr 22, 2026·Hardy Chen, Nancy Lau, Haoqin Tu +8Coding AgentsLLM Agent Evaluation
UC Santa Cruz · UT Dallas · NUS
Apr 22, 2026·Shanshan Zhong, Yi Lu, Jingjie Ning +7Continual Learning for LLM AgentsLLM Agent Evaluation
Carnegie Mellon University · Amazon AGI
Apr 21, 2026·Md Nayem Uddin, Kumar Shubham, Eduardo Blanco +2Long-Horizon Agent EvaluationAI Agent Benchmarks
Arizona State University · Genies · University of Arizona
Apr 21, 2026·Yi Zhong, Buqiang Xu, Yijun Wang +4Agentic WorkflowsBusiness Process Automation
Zhejiang University · Tencent
Apr 21, 2026·Josue Torres-Fonseca, Naihao Deng, Yinpei Dai +5LLM Safety BenchmarksLarge Language Model-Based Robot Planning
University of Michigan · Boise State University
Apr 21, 2026·Anton Kolonin, Alexey Glushchenko, Evgeny Bochkov +1LLM Agent EvaluationAI Agent Benchmarks
SingularityNET Foundation
Apr 21, 2026·Bobo Li, Rui Wu, Zibo Ji +5AI Agent BenchmarksMulti-Agent Reasoning
National University of Singapore · Sichuan University · University of Minnesota Twin Cities +2
Apr 21, 2026·Vasundra SrininvasanLong-Horizon Agent EvaluationAI Agent Benchmarks
Stanford School of Engineering
Apr 21, 2026·Daniel Shepard, Robin SalimansLLM Agent EvaluationBusiness Process Automation
Apr 20, 2026·Xirui Li, Ming Li, Ion Stoica +2Agent EvaluationAI Agent Benchmarks
University of Maryland · 5Mohamed bin Zayed University of Artificial Intelligence · 2Arena +2
Apr 20, 2026·Jiyao Liu, Jianghan Shen, Sida Song +19HealthcareAI Agent Benchmarks
Fudan University, Shanghai, China · Shanghai Artificial Intelligence Laboratory, Shanghai, China · Nanjing University, Nanjing, China +1
Apr 20, 2026·Zhaopei Huang, Yanfeng Jia, Jiayi Zhao +3AI CompanionsAI Agent Benchmarks
Renmin University of China · Beijing, China · Beihang University
Apr 20, 2026·Guanting Dong, Junting Lu, Junjie Huang +17Lifelong Learning AgentsAI Agent Benchmarks
Renmin University of China · ByteDance Seed
Apr 20, 2026·Wentao Shi, Yu Wang, Yuyang Zhao +8LLM-as-a-JudgeLLM Agent Evaluation
University of Science and Technology of China · National University of Singapore · Meituan
Apr 20, 2026·Yindong Zhang, Wenmian Yang, Yiquan Zhang +1LLM Agent OrchestrationAI Agent Benchmarks
Hong Kong Baptist University · Beijing Normal-Hong Kong Baptist University · Beijing Normal University
Apr 20, 2026·Yejin Yoon, Minseo Kim, Taeuk KimLLM PersonalizationLLM Agent Memory
Hanyang University, Seoul, Republic of Korea
Apr 20, 2026·Tianfu Wang, Zhezheng Hao, Yin Wu +5AI Agent BenchmarksAI Agent Governance
HKUST (GZ) · ZJU · USTC +1
Apr 20, 2026·Shiquan Zhang, Tianyi Zhang, Le Fang +3Mobile GUI AutomationLLM Agent Evaluation
School of Computing and Information Systems, University of Melbourne, Melbourne, Australia · School of Computer Science, University of Auckland, Auckland, New Zealand
Apr 19, 2026·Ziao Zhang, Kou Shi, Shiting Huang +13Lifelong Learning AgentsLong-Horizon Agent Evaluation
University of Science and Technology of China · University of Toronto · University of Sydney
Apr 19, 2026·Chao Jin, Wenkui Yang, Hao Sun +6GUI AgentsHallucination in Language Models
MAIS&NLPR, Institute of Automation, Chinese Academy of Sciences
Apr 18, 2026·Remy Kim, Minseung Lee, Shuo Li +1AI Agent ReliabilityAgentic Search
University of Pennsylvania, Curation Labs · Curation Labs · Google DeepMind +1
Apr 18, 2026·Sukai Huang, Chenyuan Zhang, Fucai Ke +4AI Agent EvaluationAI Agent Benchmarks
Faculty of Information Technology, Monash University
Apr 18, 2026·Brandon DentHealthcareAI Agent Benchmarks
GOATnote Inc.
Apr 17, 2026·Bhaskar GurramAI Agent ReliabilityTool-Augmented Language Model Agents
Zasti Inc., Ashburn, VA, USA
Apr 17, 2026·Zeeshan Rasheed, Abdul Malik Sami, Muhammad Waseem +3LLM Agent OrchestrationAI Agent Evaluation
*Faculty of Information Technology and Communication Sciences, Tampere University, Tampere, Finland.
Apr 17, 2026·Luay Gharzeddine, Samer SaabMulti-Agent CoordinationMulti-Agent Orchestration
1Dept of Computer Science, Lebanese American University. · 2*Dept of Electrical and Computer Engineering, Lebanese American University.
Apr 17, 2026·Hikaru Shindo, Hanzhao Lin, Lukas Helff +2LLM Agent EvaluationAI Agent Benchmarks
Technical University of Darmstadt · German Research Center for Artificial Intelligence · CERTAIN +2
Apr 17, 2026·Jize Wang, Xuanxuan Liu, Yining Li +7Tool-Use EvaluationLong-Horizon Agent Evaluation
1Shanghai Jiao Tong University · 2Shanghai AI Laboratory · 3Tencent +1