Code Completion

Momentum

9 papers in the last four weeks, up 200% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 44

All topics
CardsList
  1. Are Frontier VLM Agents Ready to Be Robot Generalists? An Empirical Study with the Embodied Agent Arena

    Oct 1, 2026Haojian Huang, Pukun Zhao, Zexi Li +7AffordancesEmpirical Study

  2. CodeMimicry: Exploiting Safety Generalization Lag in Large Language Models via Structured Code Completion

    Sep 30, 2026Zhen Liang, Hai Huang, Wentao ChenJailbreak AttacksVulnerable Code

  3. Multi-Rate Bandwidth Extension by Token Completion in Neural Audio Codecs

    Sep 29, 2026Benoît Ginies, Olivier Fercoq, Gaël RichardNeural Audio CodecsAudio Tokenizers

  4. Which Attention Heads are like the Human Head? Not the Ones that Compute

    Sep 29, 2026Christopher Pinier, Gustaw Opiełka, Hannes Rosenbusch +3Artificial Intelligence AlignmentCode Completion

  5. Printing the Underdetermined: Materializing Multi-solutionness in Figurative Paintings

    Sep 17, 2026Yutao Ming, Teng Xu, Youjia Wang +6ArtGenerative Models

  6. Revisiting Cross-View Completion: Self-Supervised Pre-Training via Reconstruction Error Comparison

    Sep 1, 2026Thibaut Loiseau, Guillaume Bourmaud, Vincent Lepetit3D PerceptionCross-View

  7. REVISE: Validity-Guided Recovery for Online Revisions in Agent Workflows

    Sep 1, 2026Ruoling Qi, Xuaner Wu, Penghang Liu +2RollbackAgentic Workflows

  8. HCGRec: Hint-Conditioned Generative Recommendation with Semantic IDs

    Aug 12, 2026Kangning Zhang, Haotian Fang, Xukun Luo +6Sequential RecommendationCode Completion

  9. Oilbird: Training-Free Speculative Decoding with Keys the Verifier Already Computes

    Aug 4, 2026Tao Jin, Phuong Minh Nguyen, Zhenzhu Yan +2Speculative DecodingDrafter

  10. AgentHPOBench: A Benchmark For Evaluating LLM Agents as Sequential Hyperparameter Optimizers

    Jul 31, 2026Tianyu Huai, Tingshuo Fan, Xinchi Chen +5Agentic BenchmarksAgentic Optimization

  11. Learning from 53.6K Real-World Developer Edits of AI-Generated Code

    Jul 27, 2026Jenny T. Liang, Mihika Bairathi, Wayne Chi +3Ai-Assisted Programming TasksCode Generation

  12. SketchMamba: A Lightweight State-Space Model for Joint Progressive Sketch Classification and Stroke Auto-Completion

    Jul 26, 2026Kavish Jhaveri, Arya ShahSketchesAutoregressive Generation

  13. The JEPA Paradox in Language: The Geometry of Linguistic Alternatives

    Jul 26, 2026Anh Trac Duc Dinh, Khang Nhat Hoang VoJoint-Embedding Predictive ArchitecturesLatent Prediction

  14. SciCodePile: A 128GB Corpus and Executable Benchmark for Challenging Scientific Code Generation

    Jul 21, 2026Weifeng Sun, Ye Fan, Yuchen Chen +6Code GenerationLarge Language Model Benchmarks

  15. Beware What You Autocomplete: Forensic Attribution of Backdoored Code Completions

    Jul 9, 2026Anjun Gao, Yueyang Quan, Zhuqing Liu +1Clean Label Backdoor AttackVulnerable Code

  16. How Much is Left? LLMs Linearly Encode Their Remaining Output Length

    Jul 6, 2026Mohamed Amine Merzouk, Dmitri Carpov, Mirko Bronzi +2Code Completion

  17. GMO-E2^2DIT: Grounded Multi-Operation Editing for E-Commerce Images

    Jul 1, 2026Zipeng Guo, Xiaoan Liu, Lichen Ma +9Image EditingPrecise Editing

  18. ShellMaker: Language-Guided Exterior Completion under Structural Constraints

    Jun 30, 2026Ruiqi Xu, Daniel AliagaIndoor Scene GenerationCraft

  19. LLM-based Visual Code Completion for Aerospace Geometric Design

    Jun 15, 2026Hau Kit Yong, Robert Marsh, Edmar A. Silva +2CopilotEngineering

  20. MIRAGE: Auditing Anti-Muslim Bias in Frontier LLMs Across Reasoning, Agentic, and Time-Coupled Conditions

    Jun 15, 2026Noor Islam S. Mohammad, Tamim SheikhLarge Language Model BiasCode Completion

  21. A Benchmark and Framework for Evaluating Next Action Predictions in Spreadsheets

    Jun 11, 2026Tejas Agrawal, Vu Le, Sumit Gulwani +1SpreadsheetsCode Completion

  22. Synthetic Hallucinations, Real Gains: Hard Negatives from Frontier Models for FIM Hallucination Mitigation

    Jun 2, 2026Mahdi Erfanian, Nelson Daniel Troncoso, Aashna Garg +4Large Language Model HallucinationCode Completion

  23. unix-ctf: Procedural Environments for Unix-Competence Reinforcement Learning

    May 27, 2026Geoffrey Bradway, Roger Creus Castanyer, Lorenz Wolf +3RobotwinExploitation

  24. BPPO: Binary Prefix Policy Optimization for Efficient GRPO-Style Reasoning RL with Concise Responses

    May 27, 2026Qingfei Zhao, Huan Song, Shuyu Tian +2Group-Based Reinforcement LearningShort

  25. Less is More: Early Stopping Rollout for On-Policy Distillation

    May 26, 2026Zhou Ziheng, Jiaqi Li, Huacong Tang +2Efficient On-Policy DistillationRollout

  26. An Empirical Study of Privacy Leakage Chains via Prompt Injection in Black-Box Chatbot Environments

    May 18, 2026Hongjang Yang, Hyunsik Na, Daeseon ChoiIndirect Prompt InjectionAttacker Large Language Model

  27. When Retrieval Hurts Code Completion: A Diagnostic Study of Stale Repository Context

    May 14, 2026Haojun Weng, Qianqian Yang, Hao Fu +2Code CompletionGradient Staleness

  28. Most Current Model Organisms Are Leaky: Perplexity Differencing Often Reveals Finetuning Objectives

    May 1, 2026Mohammed Abu Baker, Luca Baroni, Dan WilhelmLarge Language Model SafetyModel Fine-Tuning

  29. RuC: HDL-Agnostic Rule Completion Benchmark Generation

    Apr 30, 2026Arnau Ayguadé Domingo, Miquel Alberti-Binimelis, Cristian Gutierrez-Gomez +5Code CompletionRegister Transfer Level

  30. The Effect of Idea Elaboration on the Automatic Assessment of Idea Originality

    Apr 22, 2026Umberto Domanti, Moritz Mock, Sergio Agnoli +1CreativityRater

  31. GSCompleter: A Distillation-Free Plugin for Metric-Aware 3D Gaussian Splatting Completion in Seconds

    Apr 22, 2026Ao Gao, Jingyu Gong, Xin Tan +3Dynamic 3D Gaussian SplattingCompletion

  32. DocQAC: Adaptive Trie-Guided Decoding for Effective In-Document Query Auto-Completion

    Apr 20, 2026Rahul Mehta, Kavin R, Indrajit Pal +3Code CompletionQueries

  33. Precise Debugging Benchmark: Is Your Model Debugging or Regenerating?

    Apr 19, 2026Miaosen Chai, Wang Bill Zhu, Shangshang Wang +5Model DebuggingLarge Language Model Benchmarks

  34. Layer-wise MoE Routing Locality under Shared-Prefix Code Generation: Token-Identity Decomposition and Compile-Equivalent Fork Redundancy

    Apr 19, 2026Shun-ichiro Hayashi, Daichi Mukunoki, Tetsuya Hoshino +1Mixture-Of-Experts Large Language ModelsCode Generation

  35. LangMap: A Human-Verified Benchmark for Hierarchical Open-Vocabulary Goal Navigation

    Feb 2, 2026Bo Miao, Weijia Liu, Jun Luo +8Vision-Language NavigationSemantic Mapping

  36. Nested-ReFT: Efficient Reinforcement Learning for Large Language Model Fine-Tuning via Off-Policy Rollouts

    Aug 13, 2025Maxime Heuillet, Yufei Cui, Boxing Chen +2Mathematical Reasoning BenchmarksLarge Language Model Fine-Tuning