Automated Code Review

Latest papers 26

All topics
CardsList
  1. A Case Study in Assuring AI-Written Software

    Oct 6, 2026Lindsey Ferris, Sierra BonillaAI Agent ReliabilityAI Assurance

  2. Groundability, Not Scale Alone: When Weak Reviewers Can Audit Strong Coding Agents

    Oct 1, 2026Junyu Guo, Shangding Gu, Ming Jin +1AI Agent AuditingCode Generation Evaluation

  3. CRJudgeBench: Can AI Detect Plausible but Invalid Code Reviews?

    Sep 29, 2026Yue Pan, Jiawei Li, Ziyuan Zhang +2LLM EvaluationLLM-as-a-Judge

  4. From Code Review to Code Critique: Intent, Drift, and Spotlight for AI-Generated Diffs at Scale

    Jul 31, 2026Chandra Maddila, Mashrur Rashik, Euna Mehnaz Khan +4Automated Code ReviewAI-Assisted Software Development

  5. Evaluating the Impact of Explainable AI on Trust in AI-Assisted Code Review

    Jul 27, 2026Zhenhan Gao, Marvin Muñoz Barón, Umm-e Habiba +2Explainable Artificial IntelligenceAutomated Code Review

  6. Code Monitor Red Teaming for Public-Test-Passing Code

    Jul 23, 2026Junchi Liao, Jiawen Deng, Fuji RenLLM AuditingCode Generation Evaluation

  7. Cross-Model LLM Code Review: Should you use Claude to review Codex or vice versa?

    Jul 22, 2026Zuodong Xiang, Yike Zhang, YueMing Zhang +1Code Generation EvaluationAutomated Code Review

  8. Is Agentic Code Review Helpful? Mining Developers' Feedback to CodeRabbit Reviews in the Wild

    Jul 3, 2026Hong Yi Lin, Mingzhao Liang, Kla Tantithamthavorn +1Automated Code Review

  9. A Preliminary Study on Explaining Risk of Code Changes using LLM-Based Prediction Models

    Jul 2, 2026Yalin Liu, Kosay Jabre, Rui Abreu +10Automated Code Review

  10. Steerability via constraints: a substrate for scalable oversight of coding agents

    Jul 2, 2026Thomas WinningerScalable OversightCoding Agents

  11. When AI Reviews Its Own Code: Recursive Self-Training Collapse in Code LLMs

    Jun 26, 2026Xinyuan Song, Zekun Cai, Liang ZhaoSelf-TrainingModel Collapse

  12. SEVRA-BENCH: Social Engineering of Vulnerabilities in Review Agents

    Jun 11, 2026Rui Melo, Riccardo Fogliato, Sean Zhou +2Software Vulnerability DetectionAI Agent Security

  13. Beyond Summaries: Structure-Aware Labeling of Code Changes with Large Language Models

    May 25, 2026Bar Weiss, Antonio Abu-Nassar, Adi Sosnovich +1Automated Code Review

  14. Rethinking Code Review in the Age of AI: A Vision for Agentic Code Review

    May 17, 2026Hüseyin Özgür Kamalı, Erdem Tuna, Vahid Haratian +1Agentic WorkflowsAutomated Code Review

  15. MOSAIC-Bench: Measuring Compositional Vulnerability Induction in Coding Agents

    May 5, 2026Jonathan Steinberg, Oren GalLanguage Model Safety EvaluationAI Coding Agents

  16. PERSA: Reinforcement Learning for Professor-Style Personalized Feedback with LLMs

    May 1, 2026Ravi Ranjan, Utkarsh Grover, Xiaomin Lin +1Automated Code ReviewRL from Human Feedback

  17. Understanding the Limits of Automated Evaluation for Code Review Bots in Practice

    Apr 27, 2026Veli Karakaya, Utku Boran Torun, Baykal Mehmet Uçar +1LLM-as-a-JudgeHuman-in-the-Loop Evaluation

  18. AI-Assisted Code Review as a Scaffold for Code Quality and Self-Regulated Learning: An Experience Report

    Apr 25, 2026Eduardo Oliveira, Michael Fu, Patanamon Thongtanunam +2Generative AI in EducationHuman-in-the-Loop AI