Codebases

Momentum

6 papers in the last four weeks, against 1 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 37

All topics
CardsList
  1. E2E-SWE: Benchmarking LLMs on Building Working Codebases from Scratch

    Sep 29, 2026Hantian Ding, Chloe Bi, Jiacheng Zhu +5CodebasesModel Auditing

  2. RLX: A Unified Multi-Backend Tensor Compiler and Distributed Runtime in Rust

    Sep 29, 2026Eugene Hauptmann, Nataliya KosmynaDistributed OptimizationCodebases

  3. LoLBench: Evaluating Coding Agents with Long-Horizon Proposals on Large Software Systems

    Sep 29, 2026Yun Peng, Zihan Wu, Zeyang Zhuang +6CodebasesCoding Agents

  4. Towards Certificate-Driven Software Porting: A Self-Improving Agentic Harness for Scientific Program Optimization

    Sep 28, 2026Piyush Jha, Aishik Ghosh, Vijay GaneshEvolutionary SearchCode Optimization

  5. CyberForge: Verified Vulnerability Injection at Repository Level for Cybersecurity Agent Training

    Aug 6, 2026Amine Lbath, Manan Suri, Aurelien Delaitre +4Instruction Injection AttacksCodebases

  6. OctoLong: Mid-Training On Cross-Repository Code Contexts Enhances Long-Context Modeling

    Aug 5, 2026Indraneil Paul, Falko Helm, Goran Glavaš +1Efficient Long-Context InferenceCodebases

  7. Active-SWE: Benchmarking Coding Agents for Proactive Bug Fixing without Issue Reports

    Aug 5, 2026Haobin Li, Ping Deng, Weizhong Qian +4Bug DetectionCoding Agents

  8. CODENS: Transforming Code Changes into Living, Accessible, and Queryable Documentation

    Jul 20, 2026Abdelhak Kelious, Chyrine Tahri, Eliot BardetCodebasesDocumentation

  9. Quantize with Confidence? An Empirical Study of Quantization for Code Generation

    Jul 15, 2026Saima Afrin, Md. Zahidul Haque, Antonio MastropaoloQuantizedCode Generation

  10. Distributed Attacks in Persistent-State AI Control

    Jul 2, 2026Josh Hills, Ida Caspary, Asa Cooper SticklandArtificial Intelligence ControlEvasion

  11. Steerability via constraints: a substrate for scalable oversight of coding agents

    Jul 2, 2026Thomas WinningerCoding AgentsScalable Oversight

  12. Agent4cs: A Multi-agent System for Code Summarization in Large Hierarchical Codebases

    Jul 1, 2026Yongjian Tang, Ezgi Sarikayak, Doruk Tuncel +2CodebasesCoding Agents

  13. Govern the Repository, Not the Agent: Measuring Ecosystem-Level Risk in AI-Native Software

    Jun 26, 2026Daniel RussoRepository-Level Code UnderstandingCodebases

  14. Recall Before Rerank: Benchmarking Deep Learning Models for Large-Scale Code-to-Code Retrieval

    Jun 24, 2026Leonardo Venuta, Francesco Tosoni, Paolo FerraginaCodebasesCross-Encoder Reranking

  15. Accuracy and Satisfaction in Multi-Turn LLM Dialogues for NFR Assessment

    Jun 23, 2026Ali Pourghasemi Fatideh, Wilder Baldwin, Maria Dhakal +2Multi-Turn Large Language Model ConversationsCodebases

  16. DeepDiscovery: A Location-Inference Framework for Task-Level Repository Understanding

    Jun 22, 2026Jiawei He, Weisong Sun, Mengyu Shi +4CodebasesModel Discovery

  17. Code Isn't Memory: A Structural Codebase Index Inside a Coding Agent

    Jun 21, 2026Ishaan Bhola, Adithyan Krishnan, Sravanth Kurmala +1CodebasesCoding Agents

  18. JAMER: Project-Level Code Framework Dataset and Benchmark on Professional Game Engines

    Jun 18, 2026Jianwen Sun, Chuanhao Li, Zizhen Li +5Codebases

  19. Code2LoRA: Hypernetwork-Generated Adapters for Code Language Models under Software Evolution

    Jun 4, 2026Liliana Hotsko, Yinxi Li, Yuntian Deng +1CodebasesMulti-Lora

  20. AI-PROPELLER: Warehouse-Scale Interprocedural Code Layout Optimization with AlphaEvolve

    May 28, 2026Chaitanya Mamatha Ananda, Rajiv Gupta, Mircea Trofin +4Code OptimizationHardware Efficiency

  21. Converted, Not Equivalent: Benchmarking Codebase Conversion via Observational Equivalence

    May 27, 2026Linxin Song, Jiefeng Chen, Yue Huang +5CodebasesPass-Rate Evaluation

  22. Multi-agent Collaboration with State Management

    May 19, 2026Mengyang Liu, Taozhi Chen, Zhenhua Xu +2Codebases

  23. Offline Reinforcement Learning for Plasma Control in Nuclear Fusion: Codebase and Benchmark

    May 19, 2026Yang Fu, Haomin Bao, Rohit Sonker +4Nuclear FusionOffline Reinforcement Learning

  24. SWE Atlas: Benchmarking Coding Agents Beyond Issue Resolution

    May 8, 2026Mohit Raghavendra, Soham Dan, Miguel Romero Calvo +12Swe-Bench VerifiedCoding Agents

  25. SmellBench: Evaluating LLM Agents on Architectural Code Smell Repair

    May 7, 2026Ion George Dinu, Marian Cristian Mihăescu, Traian RebedeaCode QualityCodebases

  26. ProgramBench: Can Language Models Rebuild Programs From Scratch?

    May 5, 2026John Yang, Kilian Lieret, Jeffrey Ma +9Agentic BenchmarksCodebases

  27. FGDM: Reasoning Aware Multi-Agentic Framework for Software Bug Detection using Chain of Thought and Tree of Thought Prompting

    Apr 27, 2026Srita Padmanabhuni, Bhargavi Karuturi, Jerusha Karen Indupalli +2Bug DetectionCodebases

  28. SpIDER: Spatially Informed Dense Embedding Retrieval for Software Issue Localization

    Dec 18, 2025Shravan Chaudhari, Rahul Thomas Jacob, Jiajun Cao +3CodebasesSyntax

  29. LinkAnchor: An Autonomous LLM-Based Agent for Issue-to-Commit Link Recovery

    Aug 17, 2025Arshia Akhavan, Alireza Hoseinpour, Abbas Heydarnoori +2CommitsCodebases