17 papers in the last four weeks, up 113% on the four weeks before. 0.2% of all new papers.
May 7, 2026·Mahdi Erfanian, Nelson Daniel Troncoso, Aashna Garg +4Language Model Error DetectionLanguage Model Generation Evaluation
University of Illinois Chicago · Microsoft
May 7, 2026·Chengjie Wang, Jingzheng Wu, Xiang Ling +2Software EngineeringLLM Security
Intelligent Software Research Center, Institute of Software, Chinese Academy of Sciences, Beijing, China · Key Laboratory of System Software (Chinese Academy of Sciences), Beijing, China
May 6, 2026·Diego Cabezas PalaciosCode GenerationCode Generation Evaluation
May 6, 2026·Julius Näumann, Sven Keidel, Amir Molzam Sharifloo +1Code TranslationCode Generation Evaluation
∗TU Darmstadt · †Hessian Center for Artificial Intelligence, Darmstadt, Germany · ‡National Research Center for Applied Cybersecurity ATHENE
May 6, 2026·Kaifeng He, Xiaojun Zhang, Peiliang Cai +7Training Data CurationCode Generation Evaluation
Sun Yat-sen University, China · Nanyang Technological University, Singapore, Singapore · Tongji University, Shanghai, China +1
May 5, 2026·Yuxi Chen, Yutian Tang, Timothy StorerAlgorithmic BiasLanguage Model Bias Evaluation
School of Computing Science, University of Glasgow, United Kingdom.
May 4, 2026·Jiatong Li, Yuxuan Ren, Weida Wang +4AI-Assisted Scientific ResearchScientific Code Generation
The Hong Kong Polytechnic University · National University of Singapore · Fudan University
May 1, 2026·Fazle Rabbi, Lin Ling, Song Wang +1Social Bias in Language ModelsAgentic Code Generation
Concordia University, Montreal, Canada · Lassonde School of Engineering, York University, Toronto, Canada
Apr 27, 2026·Amal Akli, Mike Papadakis, Maxime Cordy +1Code Generation EvaluationLanguage Model Robustness
University of Luxembourg Luxembourg
Apr 25, 2026·William Feng, Ethan Lou, Aryan SharmaLean Theorem ProvingCode Generation Evaluation
Yale University, New Haven, Connecticut, USA.
Apr 24, 2026·Manuel Alejandro Borroto Santana, Erica Coppolillo, Francesco Calimeri +3Logic ProgrammingLLM Evaluation
University of Calabria, Rende, Italy · ICAR-CNR, Rende, Italy · Artificial Intelligence LAB, DeMaCS, University of Calabria, Rende, Italy +1
Apr 23, 2026·Minh Duc Bui, Xenia Heilmann, Mattia Cerrato +2Algorithmic BiasCode Generation Evaluation
Johannes Gutenberg University Mainz, Germany · Universidad Iberoamericana, Ciudad de Mexico · University of Colorado Boulder, USA
Apr 20, 2026·Éric JacopinCode GenerationCode Generation Evaluation
Cosmic AI
Apr 18, 2026·Jiaxin Fang, Runyuan He, Sahil Bhatia +2Structured ReasoningCode Generation Evaluation
University of California, Berkeley
Apr 18, 2026·Zixiao Zhao, Amirreza Esmaeili, Fatemeh FardSoftware EngineeringLLM-as-a-Judge
University of British Columbia, Canada
Apr 16, 2026·Alexey Khoroshilov, Alexey Chernysh, Orkhan Ekhtibarov +2Agentic Code GenerationCode Generation Evaluation
Lime
Apr 5, 2026·Yi ZhouScientific Code GenerationCode Generation Evaluation
Institute of Physics, Chinese Academy of Sciences, Beijing 100190, China
Apr 5, 2026·Hui Sun, Yun-Ji Zhang, Zheng Xie +4Language Model Generation EvaluationCode Generation Evaluation
National Key Laboratory for Novel Software Technology, Nanjing University, China · School of Artificial Intelligence, Nanjing University, China
Feb 3, 2026·Shafiuddin Rehan Ahmed, Sourabh DeshpandeAI Agent BenchmarksCode Generation Evaluation
Center for Advanced AI, Accenture · Mountain View, California, USA
Dec 15, 2025·Abdulmalik AlquwayfiliCoding AgentsCode Generation Evaluation
Saudi Data & AI Authority, Riyadh, Saudi Arabia
Oct 20, 2025·Jiahao Tang, Henry Hengyuan Zhao, Lijian Wu +8Data VisualizationCode Generation
CSU-JPG, Central South University · National University of Singapore · Nanyang Technological University
Oct 10, 2025·Kaijian Zou, Aaron Xiong, Yunxiang Zhang +6LLM EvaluationCompetitive Programming
University of Michigan, Ann Arbor.
Oct 3, 2025·Debalina Ghosh Paul, Hong Zhu, Ian BayleySoftware EngineeringCode Generation Evaluation
School of Engineering, Computing and Mathematics, Oxford Brookes University, Oxford, OX3 0BP, UK
Sep 24, 2025·Daniel Maninger, Leon Chemnitz, Amir Molzam Sharifloo +2Code GenerationCode Generation Evaluation
Technische Universität Darmstadt, Germany · Hessian Center for Artificial Intelligence (hessian.AI), Germany · Pariton AI, Germany +1
Aug 6, 2025·Sangwon Hyun, Hyunjun Kim, Jinhyuk Jang +2LLM PromptingCode Generation
Adelaide University, Adelaide, SA, Australia · Korea Advanced Institute of Science and Technology, Daejeon, Republic of Korea
Jan 18, 2025·Jialun Cao, Yuk-Kit Chan, Zixuan Ling +12Benchmark ConstructionBenchmark Design
The Hong Kong University of Science and Technology · Guangzhou HKUST Fok Ying Tung Research Institute · The Chinese University of Hong Kong +6
Date pending·Hong Zhang, Barry Smith, Satish Balay +4High-Performance ComputingCode Generation
Argonne National Laboratory, Lemont, IL, USA