Software Engineering Agents

Momentum

32 papers in the last four weeks, up 220% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 204

All topics
CardsList
  1. BLAgent: Agentic RAG for File-Level Bug Localization

    May 18, 2026Md Afif Al Mamun, Gias UddinSoftware Engineering AgentsLLM Reranking

  2. SLEIGHT-Bench: A Benchmark of Evasion Attacks Against Agent Monitors

    May 15, 2026Elle Najt, Colin Toft, Tyler Tracy +2Software Engineering AgentsAdversarial Attacks

  3. BootstrapAgent: Distilling Repository Setup into Reusable Agent Knowledge

    May 15, 2026Sihan Fu, Oucheng Liu, Shiyuan Wang +2Software Engineering AgentsLLM Agent Memory

  4. Runtime-Structured Task Decomposition for Agentic Coding Systems

    May 14, 2026Shubhi Asthana, Bing Zhang, Chad DeLuca +2Software Engineering AgentsAgentic Workflows

  5. Do Coding Agents Understand Least-Privilege Authorization?

    May 14, 2026Zheng Yan, Jingxiang Weng, Charles Chen +9Software Engineering AgentsAI Agent Security

  6. Remember Your Trace: Memory-Guided Long-Horizon Agentic Framework for Consistent and Hierarchical Repository-Level Code Documentation

    May 14, 2026Suyoung Bae, Jaehoon Lee, Changkyu Choi +2Software Engineering AgentsLLM Agent Memory

  7. SWE-Chain: Benchmarking Coding Agents on Chained Release-Level Package Upgrades

    May 14, 2026Man Ho Lam, Chaozheng Wang, Hange Liu +5Software Engineering AgentsSoftware Engineering Benchmarks

  8. CRANE: Constrained Reasoning Injection for Code Agents via Nullspace Editing

    May 13, 2026Mingzhi Zhu, Michele Merler, Raju Pavuluri +1Software Engineering AgentsAgentic Code Generation

  9. PBT-Bench: Benchmarking AI Agents on Property-Based Testing

    May 13, 2026Lucas Jing, Xinqi Wang, Liao Zhang +1Automated Software TestingSoftware Engineering Agents

  10. Turning Intent into Specifications: A Benchmark and an Interactive User-Assistant Agent

    May 13, 2026Hao Wang, Ligong Han, Kai Xu +1Requirements EngineeringSoftware Engineering Agents

  11. AI Harness Engineering: A Runtime Substrate for Foundation-Model Software Agents

    May 13, 2026Hailin Zhong, Shengxin ZhuSoftware Engineering AgentsAgent Evaluation

  12. AgentLens: Revealing The Lucky Pass Problem in SWE-Agent Evaluation

    May 13, 2026Priyam Sahoo, Gaurav Mittal, Xiaomin Li +4Agent Failure AnalysisSoftware Engineering Agents

  13. Revisiting DAgger in the Era of LLM-Agents

    May 13, 2026Changhao Li, Rushi Qiang, Jiawei Huang +4Software Engineering AgentsDataset Aggregation

  14. Counterfactual Trace Auditing of LLM Agent Skills

    May 12, 2026Xiaolin Zhou, Jinbo Liu, Li Li +2Software Engineering AgentsSoftware Engineering Benchmarks

  15. A Research Agenda on Agents and Software Engineering: Outcomes from the Rio A2SE Seminar

    May 12, 2026Davide Taibi, Henry Muccini, Karthik Vaidhyanathan +15Software Engineering AgentsAI Agent Governance

  16. On Problems of Implicit Context Compression for Software Engineering Agents

    May 11, 2026Kirill Gelvan, Igor Slinko, Felix Steinbauer +3Software Engineering AgentsLong-Horizon LLM Agents

  17. M2A: Synergizing Mathematical and Agentic Reasoning in Large Language Models

    May 11, 2026Junjian Wang, Xin Zhou, Qiran Xu +1Software Engineering AgentsAgentic Reasoning

  18. MonitoringBench: Semi-Automated Red-Teaming for Agent Monitoring

    May 10, 2026Monika Jotautaitė, Maria Angelica Martinez, Ollie Matthews +1Software Engineering AgentsAI Agent Security Benchmarks

  19. Debugging the Debuggers: Failure-Anchored Structured Recovery for Software Engineering Agents

    May 9, 2026Chenyu Zhao, Shenglin Zhang, Yihang Lin +7Agent Failure AnalysisSoftware Engineering Agents

  20. What Software Engineering Looks Like to AI Agents? -- An Empirical Study of AI-Only Technical Discourse on MoltBook

    May 8, 2026Junyu Huo, Ziqi Mao, Zihao Wan +1Software Engineering AgentsMulti-Agent Communication

  21. The AI-Native Large-Scale Agile Software Development Manifesto

    May 8, 2026Ricardo Britto, Fredrik Palmgren, Nishrith Saini +1Software EngineeringSoftware Engineering Agents

  22. From Assistance to Agency: Rethinking Autonomy and Control in CI/CD Pipelines

    May 8, 2026Marcus Emmanuel Barnes, Taher A. Ghaleb, Safwat HassanSoftware Engineering AgentsAgentic Workflows

  23. A Self-Healing Framework for Reliable LLM-Based Autonomous Agents

    May 7, 2026Cheonsu Jeong, Younggun ShinSoftware Engineering AgentsFault Detection

  24. ProgramBench: Can Language Models Rebuild Programs From Scratch?

    May 5, 2026John Yang, Kilian Lieret, Jeffrey Ma +9Software Engineering AgentsSoftware Engineering Benchmarks

  25. EngiAgent: Fully Connected Coordination of LLM Agents for Solving Open-ended Engineering Problems with Feasible Solutions

    May 4, 2026Xiyuan Zhou, Ruixi Zou, Xinlei Wang +4Multi-Agent LLM SystemsSoftware Engineering Agents