Software Engineering Agents

Momentum

32 papers in the last four weeks, up 220% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 204

All topics
CardsList
  1. UA-ChatDev: Uncertainty-Aware Multi-Agent Collaboration for Reliable Software Development

    Jul 2, 2026Temitayo Olamilekan Ogunsusi, Lijun Qian, Xishuang DongSoftware Engineering AgentsMulti-Agent Collaboration

  2. Mastermind: Strategy-grounded Learning for Repository-Scale Vulnerability Reproduction

    Jul 2, 2026Mingzhe Du, Luu Anh Tuan, Tianyi Wu +4Software Engineering AgentsCybersecurity

  3. Agent4cs: A Multi-agent System for Code Summarization in Large Hierarchical Codebases

    Jul 1, 2026Yongjian Tang, Ezgi Sarikayak, Doruk Tuncel +2Multi-Agent LLM SystemsSoftware Engineering Agents

  4. The Rollout Infrastructure Tax in Coding-Agent Reinforcement Learning

    Jul 1, 2026Daniel Thi Graviet, Lovre Pesut, Ivan Dagelic +2RL for Code GenerationSoftware Engineering Agents

  5. SWE-Doctor: Guiding Software Engineering Agents with Runtime Diagnosis from Multi-Faceted Bug Reproduction Tests

    Jul 1, 2026Yaoqi Guo, Yang Liu, Jie M. Zhang +3Software Engineering AgentsAutomated Program Repair

  6. SWE-Router: Routing in Multi-turn Agentic Software Engineering Tasks

    Jun 30, 2026Seongho Son, Sangwoong Yoon, Jiahua Tang +3Software Engineering AgentsLLM Agent Workflow Optimization

  7. MirrorCode: AI can rebuild entire programs from behavior alone

    Jun 29, 2026Tom Adamczewski, David Owen, David Rein +4Software Engineering AgentsAI Agent Benchmarks

  8. RESOURCE2SKILL: Distilling Executable Agent Skills from Human-Created Multimodal Resources

    Jun 28, 2026Yijia Fan, Zonglin Di, Zimo Wen +8Software Engineering AgentsLLM Agent Skill Learning

  9. SWE-MeM: Learning Adaptive Memory Management for Long-Horizon Coding Agents

    Jun 26, 2026Shuzheng Gao, Wenhao Zeng, Zhaojian Yu +5Software Engineering AgentsAgent Memory Management

  10. SHERLOC: Structured Diagnostic Localization for Code Repair Agents

    Jun 23, 2026Hovhannes Tamoyan, Sean Narenthiran, Erik Arakelyan +2Software Engineering AgentsAI Coding Agents

  11. DeepDiscovery: A Location-Inference Framework for Task-Level Repository Understanding

    Jun 22, 2026Jiawei He, Weisong Sun, Mengyu Shi +4LLM GroundingSoftware Engineering Agents

  12. Code Isn't Memory: A Structural Codebase Index Inside a Coding Agent

    Jun 21, 2026Ishaan Bhola, Adithyan Krishnan, Sravanth Kurmala +1Software Engineering AgentsCode Generation Evaluation

  13. TraceView: Interactive Visualization of Agentic Program Repair Trajectories

    Jun 20, 2026Amirali Sajadi, Tu Nguyen, Kimmie Huynh +2Agent Failure AnalysisSoftware Engineering Agents

  14. Phoenix: Safe GitHub Issue Resolution via Multi-Agent LLMs

    Jun 18, 2026Kipngeno Koech, Muhammad Adam, Baimam Boukar Jean Jacques +1Multi-Agent LLM SystemsSoftware Engineering Agents

  15. Dissecting model behavior through agent trajectories

    Jun 16, 2026Gaurav Gupta, Vatshank Chaturvedi, Jun Huan +1Software Engineering AgentsLLM Agent Evaluation

  16. Beyond Correctness: Enhancing Architectural Reasoning in Code LLMs via Scalable Labeling with Agentic Judgment

    Jun 12, 2026Kirill Vasilevski, Ximing Dong, Benjamin Rombaut +8Software Engineering AgentsLLM-as-a-Judge

  17. AgentBeats: Agentifying Agent Assessment for Openness, Standardization, and Reproducibility

    Jun 11, 2026Xiaoyuan Liu, Jianhong Tu, Yuqi Chen +26Software Engineering AgentsAI Agent Evaluation

  18. AgentRivet: an automated system for producing Rivet routines from journal publications

    Jun 11, 2026Antonio J. Costa, Caterina Doglioni, Christian Gütschow +2Software Engineering AgentsCode Generation

  19. Exploration Structure in LLM Agents for Multi-File Change Localization

    Jun 10, 2026Akeela Darryl Fattha, Kia Ying Chua, Lingxiao Jiang +1Software EngineeringSoftware Engineering Agents