Improvement

Momentum

16 papers in the last four weeks, up 78% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 68

All topics
CardsList
  1. Towards Optimal Policy Improvement

    Oct 1, 2026Yaniv Oren, Viliam Vadocz, Wiktor Zabka +7Boltzmann PoliciesMarkov Decision Processes

  2. Learning from Research: Toward Lifelong Agent Harness Evolution

    Sep 30, 2026Jingbo Yang, Kwei-Herng Lai, Xiaowen Wang +3Self-Evolving AgentsImprovement

  3. From Solo to Social Learning: Characterizing Recursive Social Improvement in LLMs

    Sep 29, 2026Kunal Jha, Max Kleiman-Weiner, Natasha JaquesSelf-Improving AgentsLarge Language Model Agents

  4. Skill-Space Shooting for Autonomous Robot Policy Improvement

    Sep 29, 2026Zihang Rui, Renhao Wang, Haoxu Huang +1Self-Improving AgentsRobot Systems

  5. RSI-Master: Structuring Experiments to Guide Autonomous Model Improvement

    Sep 28, 2026Yaxin Du, Xiyuan Yang, Zhifan Zhou +10Recursive Self-ImprovementArtificial Intelligence Research

  6. From internal representations to model improvement through prediction errors

    Sep 28, 2026Yushi Nakaya, Kenichi Higuchi, Shuichi IshidaPrediction ErrorRarity

  7. NLPG: Natural-Language Policy Gradients for Self-Evolving Language Agents

    Sep 27, 2026Xu Liu, WenZhang Wei, Jun Cao +4Large Language Model Policy OptimizationImprovement

  8. SWE-Prometheus: Measuring Engineering Governance Improvements in Real-World Repositories

    Sep 24, 2026Jiajun Wu, Leixin Sun, Zihan Tan +9Repository-Level Code UnderstandingGovernance

  9. MIRCID: Inferred Hub-miRNAs Drive Cross-Task Improvements in Drug Mechanistic Modeling

    Sep 18, 2026Xin Cao, Yigang Chen, Jiatong Xu +11TranscriptomicsImprovement

  10. CARE-VI: Conservative Adaptive Reliability Estimation for Value Improvement in Off-Policy Actor-Critic Learning

    Sep 17, 2026Xiang Zou, Shengzhu Shi, Junqi Gao +1Soft Actor-CriticTemporal Difference

  11. Data-Efficient Language Modeling: From Frontier Advancement to Principle-Guided Model Improvement

    Sep 12, 2026Shuxing Yang, Kaihao Zhu, Junjie Yang +13Frontier ModelsFrontiers

  12. Emergency Department Revisit Quality Review Screening: Exploring Human Decision-Making and Artificial Intelligence Support

    Sep 9, 2026Jonathan A. Handler, Marlene I. Robles-Granda, Jacob E. Mefford +5Clinician TrustEmergency Departments

  13. Evaluating and Improving Evidence-Grounded Fact-Checking in LLMs via Multi-Round Evidence Ablation

    Sep 8, 2026Xingyu Deng, Mingzi Cao, Nikolaos Aletras +2Fact-CheckingLarge Language Model Reliability

  14. OBER+: Continuity-Aware Reporting and Traceable Continuous Improvement in Outcome-Based Education

    Sep 3, 2026Elakkiya RajasekarInstitutionsCurriculum

  15. Harness-of-Harness: Multi-Day Autonomous Software Development with Continual Improvement

    Sep 1, 2026Haoyang Yan, Min-le Su, Hangfan Zhang +6Self-Improving AgentsCoding Agents

  16. LLM Post-Training as Brownfield Maintenance: An Industrial Perspective on Dataware Engineering

    Aug 31, 2026Gopi Krishnan Rajbahadur, Amir M. Ebrahimi, Boyuan Chen +1Post-TrainingTraining Data

  17. Self-Aware Active Learning Enables Continual Improvement in Autonomous Driving

    Aug 30, 2026Dong Hu, Chao Huang, Carman K. M. Lee +1Autonomous DrivingPool-Based Active Learning

  18. LLM-Guided Graph Generation for Structure-Based Local Improvement Methods

    Aug 13, 2026Hai Xia, Vaidyanathan Peruvemba Ramaswamy, Stefan SzeiderLarge Neighborhood SearchData Generation

  19. Numeracy in Large Language Models: Fundamental Limitations and Paths to Improvement

    Aug 13, 2026Aoxin NiMathematical Reasoning BenchmarksFundamental Limits

  20. Expert-Guided g-computation with Large Language Models for Estimating Causal Effects on Timings: Applications to Hospital Quality Improvement

    Aug 11, 2026Patrick Vossler, Jialin Ouyang, F. Richard Guo +5Patient TrajectoriesImprovement

  21. Improving Auto-Design of Neural PDE Solvers with a Domain-Specific Language

    Aug 5, 2026Shengxin Kong, Liwen Xu, Jingwen FuNeural Partial Differential Equation SolversEvolutionary Search

  22. FinReportBench: Measuring and Improving Institution-Grade Financial Report Generation

    Aug 5, 2026Yinghao Tang, Tan Zhenwei, Yiyao Wang +4ReportModel Auditing

  23. Simple-regret rates and minimax optimality of fixed-prior expected improvement in Matérn and squared-exponential RKHSs

    Jul 31, 2026Emmanuel Vazquez, Sébastien PetitReproducing Kernel Hilbert SpacesMinimax Rate

  24. SWE-NFI: Studying and Benchmarking Coding Agents for Non-Functional Improvements

    Jul 29, 2026Pengyu Xue, He Yang Yuan, Xin Wang +6Coding AgentsAgentic Benchmarks

  25. Teach it to stop, not just to click

    Jul 19, 2026Barada Sahu, Shivesh PandeyAgenticImprovement

  26. Evaluating Neural Decompilation of Dart AOT Binaries: Fine-Tuning, Metric Validity, Specification Leakage, and Reliability

    Jul 7, 2026Raafat Abualazm, Ayman AboElhassan, Amr G. WassalModel Fine-TuningHuman-Annotated Benchmark

  27. Profit-Based Counterfactual Explanations for Product Improvement: A Case Study of Manga Sales in Japan

    Jul 2, 2026Keita Kinjo, Takeshi EbinaCounterfactual ExplanationShapley Additive Explanations

  28. What Drives Interactive Improvement from Feedback?

    Jun 29, 2026Bartłomiej Cupiał, Jan Łojek, Mikołaj Garstecki +3FeedbackReinforcement Learning From Human Feedback

  29. Improved Large Language Diffusion Models

    Jun 24, 2026Shen Nie, Qiyang Min, Shaoxuan Xu +7Diffusion Language ModelsDiffusion Models

  30. Closed-loop Auto Research for Molecular Property Prediction: Discovering and Certifying Generalizable Improvements

    Jun 22, 2026Jingjie Ning, Xiaochuan Li, Ji Zeng +2Molecular Property PredictionMoleculenet

  31. LOKI: Memory-Free Null-Space Constrained Lifelong Knowledge Editing

    Jun 18, 2026Masih Eskandar, Miquel Sirera Perelló, Stratis Ioannidis +1Multimodal Knowledge EditingLarge Language Model Memory

  32. The Illusion of Improvement: Reject Inference Strategies in Credit Scoring

    Jun 16, 2026Bruno Scarone, Ricardo Baeza-YatesRejectionSelection Bias

  33. OmniGameArena: A Unified UE5 Benchmark for VLM Game Agents with Improvement Dynamics

    Jun 8, 2026Mingxian Lin, Shengju Qian, Yuqi Liu +9Agentic BenchmarksWebarena Domains

  34. Coherent Off-Policy Improvement of Large Behavior Models with Learned Rewards

    Jun 1, 2026Christian Scherer, Joe Watson, Theo Gruner +3Reinforcement Fine-TuningDexterous Manipulation

  35. Improvise, Adapt, Overcome: An On-The-Fly Multifidelity Algorithm for Efficient Machine Learning

    Jun 1, 2026Vivin Vinod, Peter ZaspelQuantum ChemistryMulti-Fidelity

  36. Linear Strategic Classification with Endogenous Improvements

    May 31, 2026Siddharth Shrivastava, Mahvith Akshintala, B Vamsha Vardhan Reddy +3ClassifierImprovement

  37. StressDream: Steering Video World Models for Robust Policy Evaluation and Improvement

    May 29, 2026Junwon Seo, Sushant Veer, Ran Tian +6Video World ModelsDream

  38. Welfare, Improvability, and Variance: A Principal-Agent Approach to Optimal Benchmark Item Aggregation

    May 29, 2026Andreas Haupt, Justin Hartenstein, Anka Reuel +2WelfareAgentic Benchmarks

  39. CORE: Contrastive Reflection Enables Rapid Improvements in Reasoning

    May 27, 2026Linas Nasvytis, Simon Jerome Han, Ben Prystawski +3Contrastive LearningImprovement

  40. ImProver 2: Iteratively Self-Improving LMs for Neurosymbolic Proof Optimization

    May 21, 2026Riyaz Ahuja, Tate Rowney, Jeremy Avigad +1Theorem ProvingNeuro-Symbolic Framework

  41. Task Capability Improvement Algorithm for Collaborative Manipulators

    May 17, 2026Keshab Patra, Arpita Sinha, Anirban GuhaImprovementTransport

  42. 4DVGGT-D: 4D Visual Geometry Transformer with Improved Dynamic Depth Estimation

    May 12, 2026Ying Zang, Xuanyi Liu, Yidong Han +94D ReconstructionVisual Geometry Grounded Transformer

  43. Unlearning with Asymmetric Sources: Improved Unlearning-Utility Trade-off with Public Data

    May 11, 2026Ahmed Mehdi Inane, Vincent Quirion, Gintare Karolina Dziugaite +1Unlearning MethodMembership Inference Attacks

  44. Improved Model-based Reinforcement Learning with Smooth Kernels

    May 8, 2026Kun Long, Yuqiang Li, Xianyi WuModel-Based Reinforcement LearningOffline Reinforcement Learning

  45. Physical Fidelity Reconstruction via Improved Consistency-Distilled Flow Matching for Dynamical Systems

    May 7, 2026Sicheng Ma, Tianyue Yang, Xiuzhe Wu +1High-FidelityReconstruction Fidelity

  46. Leveraging Code Automorphisms for Improved Syndrome-Based Neural Decoding

    May 5, 2026Raphaël Le Bidan, Ahmad Ismail, Elsa Dupraz +1Neural CodecsImprovement

  47. Conformalized Percentile Interval: Finite Sample Validity and Improved Conditional Performance

    May 4, 2026Ran Zou, Wanrong Zhu, Bin NanConditional DistributionFinite-Sample

  48. From Fuzzy to Formal: Scaling Hospital Quality Improvement with AI

    Apr 21, 2026Patrick Vossler, Jean Feng, Venkat Sivaraman +9Qualitative ResearchImprovement

  49. Improvements to the post-processing of weather forecasts using machine learning and feature selection

    Apr 21, 2026Kazuma Iwase, Tomoyuki TakenawaPrecipitation NowcastingPost-Processing