3 papers in the last four weeks, against 1 the four weeks before. 0.0% of all new papers.
Oct 6, 2026·Lindsey Ferris, Sierra BonillaAI Agent ReliabilityAI Assurance
Independent Researcher · University College London London, United Kingdom
Oct 1, 2026·Tae-Eun SongLLM EvaluationLanguage Model Error Detection
Daejeon Jungang Cheonggua Co., Ltd.
Oct 1, 2026·Junyu Guo, Shangding Gu, Ming Jin +1AI Agent AuditingCode Generation Evaluation
University of California, Berkeley · Virginia Tech
Sep 29, 2026·Yue Pan, Jiawei Li, Ziyuan Zhang +2LLM EvaluationLLM-as-a-Judge
University College London · Amazon · Zhejiang University
Aug 10, 2026·Ivan WiryadiLLM AuditingSoftware Vulnerability Detection
Independent.
Aug 2, 2026·Rasvik Kudum, Max Corbett, Hitansh Paliwal +3LLM EvaluationLLM Decision-Making
Jul 31, 2026·Chandra Maddila, Mashrur Rashik, Euna Mehnaz Khan +4Automated Code ReviewAI-Assisted Software Development
Meta, USA · †Concordia University, Montreal, Canada
Jul 27, 2026·Zhenhan Gao, Marvin Muñoz Barón, Umm-e Habiba +2Explainable Artificial IntelligenceAutomated Code Review
Technical University of Munich, Heilbronn, Germany · University of Hohenheim, Hohenheim, Germany
Jul 23, 2026·Junchi Liao, Jiawen Deng, Fuji RenLLM AuditingCode Generation Evaluation
University of Electronic Science and Technology of China Chengdu, China
Jul 22, 2026·Zuodong Xiang, Yike Zhang, YueMing Zhang +1Code Generation EvaluationAutomated Code Review
University of California, Davis USA · Johns Hopkins University USA · California State University, Long Beach USA
Jul 21, 2026·Yohann SidotLLM Agent SecurityIndirect Prompt Injection
Senthex Research
Jul 3, 2026·Hong Yi Lin, Mingzhao Liang, Kla Tantithamthavorn +1Automated Code Review
The University of Melbourne, Melbourne, Victoria, Australia · Monash University, Melbourne, Victoria, Australia
Jul 2, 2026·Yalin Liu, Kosay Jabre, Rui Abreu +10Automated Code Review
Meta Platforms, Inc. · Concordia University
Jul 2, 2026·Thomas WinningerScalable OversightCoding Agents
Télécom SudParis, Évry-Courcouronnes, France · ENS Paris-Saclay, Gif-sur-Yvette, France
Jun 26, 2026·Xinyuan Song, Zekun Cai, Liang ZhaoSelf-TrainingModel Collapse
Emory University, Atlanta, GA, USA · The University of Tokyo, Tokyo, Japan · LocationMind, Tokyo, Japan
Jun 11, 2026·Rui Melo, Riccardo Fogliato, Sean Zhou +2Software Vulnerability DetectionAI Agent Security
1Carnegie Mellon University · 2Microsoft Core AI · 3Independent Researcher +1
May 28, 2026·Chris Adams, Arjun Singh Banga, Parveen Bansal +28Automated Code ReviewAI-Assisted Software Development
Meta · USA, UK, Canada
May 25, 2026·Bar Weiss, Antonio Abu-Nassar, Adi Sosnovich +1Automated Code Review
Viterbi Faculty of Electrical and Computer Engineering Technion, Haifa, Israel · IBM Research Haifa, Israel
May 21, 2026·Kaushal BansalPersona PromptingAutomated Code Review
Salesforce, Inc. San Francisco, CA, USA
May 17, 2026·Hüseyin Özgür Kamalı, Erdem Tuna, Vahid Haratian +1Agentic WorkflowsAutomated Code Review
Department of Software Engineering Ankara University Ankara, Turkey · Microsoft Ankara, Turkey · Department of Computer Engineering Bilkent University Ankara, Turkey
May 8, 2026·Zixuan Xie, Xinyu Liu, Shangtong ZhangLLM EvaluationLLM Agent Evaluation
University of Virginia
May 5, 2026·Jonathan Steinberg, Oren GalLanguage Model Safety EvaluationAI Coding Agents
Swarms & AI Lab (SAIL), University of Haifa
May 1, 2026·Ravi Ranjan, Utkarsh Grover, Xiaomin Lin +1Automated Code ReviewRL from Human Feedback
Florida International University (FIU), Miami, USA
Apr 27, 2026·Veli Karakaya, Utku Boran Torun, Baykal Mehmet Uçar +1LLM-as-a-JudgeHuman-in-the-Loop Evaluation
Bilkent University Ankara, Turkey · Beko İstanbul, Turkey
Apr 25, 2026·Eduardo Oliveira, Michael Fu, Patanamon Thongtanunam +2Generative AI in EducationHuman-in-the-Loop AI
The University of Melbourne Melbourne, Australia · University of Eastern Finland Joensuu, Finland
Apr 21, 2026·Abhinav AgarwalSoftware Vulnerability DetectionLLMs for Cybersecurity