AI Coding Agents

Momentum

28 papers in the last four weeks, up 115% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 212

All topics
CardsList
  1. Can LLM Coding Agents Reason About Time Series?

    Jun 15, 2026Filip Rechtorík, Ondřej Dušek, Zdeněk KasnerTime Series ReasoningTime Series QA

  2. RHO: Your Coding Agent is Secretly a Roboticist

    Jun 15, 2026Karim Elmaaroufi, Justin Svegliato, Sarunas Kalade +3Robot Policy LearningAI Coding Agents

  3. ClayBuddy: A Framework, Evaluation, & Mitigation of Coding Agent Failures

    Jun 13, 2026Kenneth Ge, Andre AssisAgent Failure AnalysisAI Coding Agents

  4. CODA-BENCH: Can Code Agents Handle Data-Intensive Tasks?

    Jun 13, 2026Yuxin Zhang, Ju Fan, Meihao Fan +2AI Coding AgentsSoftware Engineering Benchmarks

  5. Mining Architectural Quality Under Agentic AI Adoption: A Causal Study of Java Repositories

    Jun 11, 2026Oliver Aleksander Larsen, Mahyar T. MoghaddamAI Coding AgentsAutomated Software Engineering

  6. Claw-SWE-Bench: A Benchmark for Evaluating OpenClaw-style Agent Harnesses on Coding Tasks

    Jun 10, 2026Mengyu Zheng, Kai Han, Boxun Li +13AI Coding AgentsSoftware Engineering Benchmarks

  7. Exploration Structure in LLM Agents for Multi-File Change Localization

    Jun 10, 2026Akeela Darryl Fattha, Kia Ying Chua, Lingxiao Jiang +1Software EngineeringSoftware Engineering Agents

  8. AI Coding Agents in Social Science: Methodologically Diverse, Empirically Consistent, Interpretively Vulnerable

    Jun 9, 2026Meysam Alizadeh, Fabrizio Gilardi, Mohsen Mosleh +1AI Agent ReliabilityAI Coding Agents

  9. AI Coding Agents Can Reproduce Social Science Findings

    Jun 9, 2026Meysam Alizadeh, Mohsen Mosleh, Fabrizio Gilardi +2AI Coding AgentsAI Agent Benchmarks

  10. AutoPDE: Reliable Agentic PDE Solving via Explicitly Represented Solver Strategies

    Jun 9, 2026Huanshuo Dong, Keyao Zhang, Hong Wang +6AI Coding AgentsPDE Solving

  11. SWE-Explore: Benchmarking How Coding Agents Explore Repositories

    Jun 5, 2026Shaoqiu Zhang, Yuhang Wang, Jialiang Liang +8AI Coding AgentsAgentic Search

  12. SWE-Marathon: Can Agents Autonomously Complete Ultra-Long-Horizon Software Work?

    Jun 5, 2026Rishi Desai, Jesse Hu, Joan Cabezas +23AI Coding AgentsSoftware Engineering Benchmarks

  13. Asuka-Bench: Benchmarking Code Agents on Underspecified User Intent and Multi-Round Refinement

    Jun 4, 2026Xin Wang, Liangtai Sun, Yaoming Zhu +8Computer-Use Agent BenchmarksLanguage Model Generation Evaluation

  14. Microskill Architecture: A Modular Skill-Driven Framework for AI-Native Code Generation

    Jun 4, 2026Mohammad Zare, Omid AbdolrahmaniAI Coding AgentsAgentic Code Generation

  15. Coding with "Enemy": Can Human Developers Detect AI Agent Sabotage?

    Jun 4, 2026Jingheng Ye, Huiqi Zou, Simon Yu +1AI Coding AgentsAI Agent Monitoring

  16. TensorBench: Benchmarking Coding Agents on a Compiler-Based Tensor Framework

    Jun 4, 2026Bobby Yan, Fredrik KjolstadAI Coding AgentsBenchmark Design

  17. ADK Arena: Evaluating Agent Development Kits via LLM-as-a-Developer

    Jun 4, 2026Jintao Huang, Xiaomin Li, Gaurav Mittal +1AI Coding AgentsLLM Agent Evaluation

  18. Can Generalist Agents Automate Data Curation?

    Jun 2, 2026Feiyang Kang, Hanze Li, Adam Nguyen +5AI Coding AgentsTraining Data Curation

  19. The Impact of Configuring Agentic AI Coding Tools on Build-vs-Buy Decisions: A Study Protocol

    Jun 2, 2026Jai Lal Lulla, Matthias Galster, Jie M. Zhang +2Software EngineeringAI Coding Agents

  20. RealClawBench: Live OpenClaw Benchmarks from Real Developer-Agent Sessions

    Jun 2, 2026Zongwei Lv, Zhewen Tan, Yaoming Li +7Computer-Use Agent BenchmarksAI Coding Agents

  21. Cross-Lingual Token Arbitrage: Optimizing Code Agent Context Windows via Local LLM Preprocessing

    Jun 2, 2026Mehmet Utku ColakAI Coding AgentsLLM Prompting

  22. Agentic-J: An AI Agent for Biological Microscopy Image Analysis

    Jun 1, 2026Lukas Johanns, Marilin Moor, Davide Panzeri +9AI Coding AgentsScientific Workflow Automation

  23. Algorithmic algorithm development with LLMs: A Case Study on LLM-Usage for Contraction Order Optimization in Tensor Networks

    Jun 1, 2026Fabian Hoppe, Melven Röhrig-Zöllner, Philipp KnechtgesTensor NetworksAutomated Algorithm Discovery