LLM Self-Refinement

LLM: Large Language Model

Latest papers 62

All topics
CardsList
  1. RefCon: Iterative Refinement and Contrastive Memory Extraction for Context-Evolving Agent

    Sep 30, 2026Ubaidillah Ariq Prathama, Bo Liu, Yeo Boon Hong +3Contrastive LearningLLM Self-Refinement

  2. AREX-2: Advancing Self-Improving Agents through Long-Horizon Reflective Tasks

    Sep 29, 2026Hongjin Qian, Chaofan Li, Kun Luo +11LLM Self-RefinementLLM Agent Training

  3. WeaveData: A Multimodal Data Analysis System with Self-Critiquing and Self-Evolving LLM Plans

    Sep 28, 2026Min Jia, Shihao Zhou, Jun-Peng Zhu +9LLM Self-RefinementLLM Planning

  4. What Drives Recovery in Agentic Text-to-Cypher? LAST-CQ: An LLM Agent Self-Refinement Framework

    Sep 14, 2026Ioannis Prokopiou, Athanasios Aidinis, Panagiotis-Christos Kyrmpatsos +1LLM Self-RefinementLLM Agent Evaluation

  5. Vibe Patenting: Evaluating LLM Judges for Professional Patent-Drafting Agents

    Sep 11, 2026Toshiaki Koike-Akino, Vladislav Blaykhman, Ye Wang +2LLM Self-RefinementLLM-as-a-Judge

  6. ReDeck: Step-Level Render-Grounded Refinement for Document-to-Slide Generation

    Aug 31, 2026Muzhao Tian, Zezi Zeng, Yifan Yang +14LLM Self-RefinementGenerative AI Evaluation

  7. Co-Evolving Actor-Conditioned Critics for Non-Verifiable Generation

    Aug 31, 2026Jinyoung Kim, Muhammad Khalifa, Lajanugen Logeswaran +4RL for Language ModelsLLM Evaluation

  8. Optimal Stopping of Self-Refining Foundation Models

    Aug 11, 2026Kim Hammar, Tansu Alpcan, Emil C. LupuLLM Self-RefinementOptimal Stopping

  9. SafeQL: Search-based Refinement for Safe and Efficient LLM-based Text-to-SQL

    Aug 10, 2026Geonho Lee, Min-Soo KimLLM Self-RefinementText-to-SQL

  10. Progressive Content Refinement with Decaying Reward Joint LinUCB

    Aug 7, 2026Shion Ishikawa, Pablo Loyola, Young-joo Chung +1LLM Self-RefinementLarge Language Model-Guided Optimization

  11. Refining Over Resampling: Test-Time Self-Correction for LLM Reasoning

    Aug 6, 2026Ahsan Bilal, Muhammad Ahmed Mohsin, Muhammad Umer +4Numerical Reasoning in Language ModelsLLM Self-Correction

  12. RefactorAssist: Agentic Refinement for Reliable Code Refactoring

    Aug 2, 2026Jonathan Cordeiro, Shayan Noei, Ying ZouLLM Self-RefinementAutomated Program Repair

  13. When Does LLM Orchestration Pay Off? A Controlled Evaluation of Accuracy, Cost, and Task Difficulty

    Aug 1, 2026Nicolas Leins, Nico Pelleriti, Jana Gonnermann-Müller +1LLM EvaluationLLM Self-Refinement

  14. Reflection or Re-Generation? Why LLM Revision Fails Where Human Revision Succeeds

    Jul 31, 2026Yefan Tao, Gerald Friedland, Madhusudhanan Chandrasekaran +1LLM Self-CorrectionLLM Self-Refinement

  15. Failures Reveal What Metrics Miss: An Evidence-Driven Agent for Recursive Refinement of ECG Classifiers

    Jul 27, 2026Jinliang Deng, Yiming Niu, Yibo Pan +3LLM Self-RefinementElectrocardiogram Classification

  16. Teaching LLMs to Self-Evolve: Cultivating Core Meta-Skills with Reinforcement Learning

    Jul 24, 2026Shujin Wu, Cheng Qian, Xiusi Chen +1RL for Code GenerationLLM Self-Refinement

  17. Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops

    Jul 8, 2026Mingguang Chen, Licheng Wang, Bo QuLLM Self-RefinementHuman-in-the-Loop Evaluation

  18. Contrastive Reflection for Iterative Prompt Optimization

    Jun 29, 2026Derek Koh, Jinghui Mo, Benjamin H. Le +7LLM Self-RefinementLLM Agent Workflow Optimization

  19. What Drives Interactive Improvement from Feedback?

    Jun 29, 2026Bartłomiej Cupiał, Jan Łojek, Mikołaj Garstecki +3LLM Self-RefinementLLM Agent Evaluation

  20. Towards Reliable and Robust LLM Planning: Symbolic Feedback-Driven Iterative Self-Refinement Framework

    Jun 26, 2026Jiajing Zhang, Jiamei Jiang, Chenyang Zhang +3LLM Self-RefinementLLM Planning

  21. When Does Intrinsic Self-Correction Help? A Task-Sensitive Analysis

    Jun 22, 2026Elroy Stav, Dvir Berlowitz, Maayan Orner +1LLM Self-CorrectionLLM Evaluation

  22. ScholarSum: Student-Teacher Abstractive Summarization via Knowledge Graph Reasoning and Reflective Refinement

    Jun 17, 2026Bohou Zhang, Xiaoyu Tao, Mingyue Cheng +2LLM Self-RefinementGraph Retrieval-Augmented Generation

  23. (Auto)formalization is supposed to be easy: Trellis process semantics for spelling out rigorous proofs

    Jun 8, 2026Wesley PegdenLLM Self-RefinementLLM Agents

  24. Closing the Prior-Posterior Loop: Self-Reflective Molecular Design with Analysis-Driven LLM Iteration

    Jun 8, 2026Junyi Gong, Zijie Qiu, Ben Zhong TangMolecular OptimizationLLM Self-Refinement

  25. Reasoning without Gold Standards: A Proxy-Judge Theory of Autoformalization

    Jun 8, 2026Lei Xu, Xin Quan, André FreitasLLM Self-RefinementLLM-as-a-Judge

  26. FLARE: Fine-Grained Diagnostic Feedback for LLM Code Refinement

    Jun 2, 2026Yinsheng Yao, Hongxiang Zhang, Weixi Tong +1LLM Self-RefinementAutomated Program Repair

  27. On the Generalization Gap in Self-Evolving Language Model Reasoning

    May 31, 2026Zhenting Qi, Susanna Maria Baby, Stefanie Anna Baby +5LLM Self-RefinementLanguage Modeling

  28. What Am I Missing? Question-Answering as Hidden State Probing

    May 29, 2026Chu Fei Luo, Samuel Dahan, Xiaodan ZhuLLM Self-RefinementLanguage Model Self-Assessment

  29. Honest Lying: Understanding Memory Confabulation in Reflexive Agents

    May 28, 2026Prakhar Dixit, Sadia Kamal, Tim OatesAI Agent ReliabilityLLM Self-Refinement

  30. Hallucination Detection-Guided Preference Optimization for Clinical Summarization

    May 27, 2026Shamanth Kuthpadi Seethakantha, Dung Ngoc Thai, Vara Prasad Gudi +6LLM Self-RefinementLLM Hallucination Mitigation

  31. CORE: Contrastive Reflection Enables Rapid Improvements in Reasoning

    May 27, 2026Linas Nasvytis, Simon Jerome Han, Ben Prystawski +3LLM Self-RefinementEfficient Language Model Reasoning

  32. CoSPlay: Cooperative Self-Play at Test-Time with Self-Generated Code and Unit Test

    May 22, 2026Zhangyi Hu, Chenhui Liu, Tian Huang +6LLM Self-RefinementExecution-Guided Code Generation

  33. Self-Refining Topology Optimization via an LLM-Based Multi-Agent Framework

    May 22, 2026Hyunjee Park, Hayoung ChungTopology OptimizationMulti-Agent LLM Systems

  34. ImProver 2: Iteratively Self-Improving LMs for Neurosymbolic Proof Optimization

    May 21, 2026Riyaz Ahuja, Tate Rowney, Jeremy Avigad +1LLM Self-RefinementAutomated Theorem Proving

  35. Reflective Prompt Tuning through Language Model Function-Calling

    May 20, 2026Farima Fatahi Bayat, Moin Aminnaseri, Pouya Pezeshkpour +1LLM Self-RefinementLLM Prompting

  36. REFLECTOR: Internalizing Step-wise Reflection against Indirect Jailbreak

    May 20, 2026Jiachen Ma, Jiawen Zhang, Xiangtian Li +3LLM Self-RefinementLLM Safety

  37. A-ProS: Towards Reliable Autonomous Programming Through Multi-Model Feedback

    May 18, 2026Anika Tabassum, Md Sifat Hossain, Md. Fahim Arefin +2LLM Self-RefinementExecution-Guided Code Generation

  38. STRIDE: A Self-Reflective Agent Framework for Reliable Automatic Equation Discovery

    May 18, 2026Jiarui Su, Songjun Tu, Bei Sun +1LLM Self-RefinementAI Agents for Scientific Discovery

  39. What Does LLM Refinement Actually Improve? A Systematic Study on Document-Level Literary Translation

    May 13, 2026Shaomu Tan, Dawei Zhu, Ke Tran +5LLM Self-RefinementDocument-Level MT

  40. ICRL: Learning to Internalize Self-Critique with Reinforcement Learning

    May 13, 2026Jianbo Lin, Xiaomin Yu, Yi Xin +7RL for Language ModelsLLM Self-Refinement

  41. Interactive Critique-Revision Training for Reliable Structured LLM Generation

    May 8, 2026Fei Xu Yu, Zuyuan Zhang, Mahdi Imani +2LLM Self-RefinementGroup Relative Policy Optimization

  42. TheraAgent: Self-Improving Therapeutic Agent for Precise and Comprehensive Treatment Planning

    May 7, 2026Junkai Li, Yunghwei Lai, Tianyi Zhu +3LLM Self-RefinementHealthcare

  43. LLM-ReSum: A Framework for LLM Reflective Summarization through Self-Evaluation

    Apr 28, 2026Huyen Nguyen, Haoxuan Zhang, Yang Zhang +2LLM EvaluationLLM Self-Refinement

  44. Evaluating Remote Sensing Image Captions Beyond Metric Biases

    Apr 22, 2026Ziyun Chen, Fan Liu, Liang Yao +3VLM EvaluationRemote Sensing Image Understanding

  45. A Multi-Agent Framework with Structured Reasoning and Reflective Refinement for Multimodal Empathetic Response Generation

    Apr 21, 2026Liping Wang, Cheng Ye, Weidong Chen +3LLM Self-RefinementMultimodal Reasoning

  46. ProtoCycle: Reflective Tool-Augmented Planning for Text-Guided Protein Design

    Apr 18, 2026Yutang Ge, Guojiang Zhao, Sihang Li +7LLM Self-RefinementLLM Tool Use

  47. RefineRL: Advancing Competitive Programming with Self-Refinement Reinforcement Learning

    Apr 1, 2026Shaopeng Fu, Xingxing Zhang, Li Dong +1RL for Code GenerationLLM Self-Refinement

  48. SpecMind: Cognitively Inspired, Interactive Multi-Turn Framework for Postcondition Inference

    Feb 24, 2026Cuong Chi Le, Minh V. T Pham, Tung Vu Duy +4LLM Self-RefinementLLM Prompting