Feedback

Momentum

70 papers in the last four weeks, up 250% on the four weeks before. 0.7% of all new papers.

Jul 13Week of Sep 28

Latest papers 341

All topics
CardsList
  1. Feedback Without the Wait: Piloting a Generative AI Practice Platform in a Large Maths Class

    Oct 1, 2026Lili Chen, Gavin Buskes, Yuxin Ren +1Generative Artificial IntelligenceFeedback

  2. An Educator-Guided LLM Pedagogical Agent for Scaffolded Feedback in Conceptual Database Design

    Oct 1, 2026Sara Riazi, Pedram RooshenasFeedbackPedagogical Frameworks

  3. Learning When and How to Intervene: A Hindsight-Distilled Sentinel for Coding Agents

    Sep 30, 2026Jiangrui Zhao, Chenglong Li, Meng Zhang +1Coding AgentsHindsight

  4. ConflictGuide: AutoResearch Improves When Competing Behaviors Are Made Visible

    Sep 30, 2026Binqian Xu, Qiran Zou, Xiangbo Shu +1Code QualityAdversarial Evaluation

  5. A2Z GameSpec-Bench: How Faithfully Can Coding Agents Generate Games from Game Design Specifications?

    Sep 30, 2026Seonho Lee, Wonryeol Jeong, Alberto Cereser +4Test GenerationFeedback

  6. Mutual Equilibrium: Multimodal Representation Learning through Reciprocal Feedback

    Sep 30, 2026Ho-min Park, Byungkon KangMultimodal RepresentationsMultimodal Classification

  7. Robust Risk-Sensitive Reinforcement Learning from Corrupted Human Feedback

    Sep 30, 2026Xinyi Ni, Lifeng LaiReinforcement Learning From Human FeedbackConditional-Value-At-Risk

  8. Adaptive Self-Consistency: From Black-Box Sampling to Distribution-Valued Feedback

    Sep 30, 2026Jingkai Huang, Yunfan Zhang, Will Ma +2Self-ConsistencySelf-Distillation Framework

  9. Training LLM Judges from Language Feedback via Position-Selective Self-Distillation

    Sep 30, 2026Ilgee Hong, Changlong Yu, Zhenghao Xu +5Self-Distillation FrameworkLarge Language Model Judges

  10. UniEvo-VL: An On-policy Self-Distillation Training Recipe for Multimodal Model Self-improvement

    Sep 30, 2026Fang Wu, Da Xing, Yanjie Huang +16Multimodal ModelSelf-Evolution

  11. Understanding Off- vs On-Policy Distillation: A Tale of Distinct Training Objectives

    Sep 29, 2026Qiwei Di, Xuheng Li, Kaixuan Ji +3Kullback-Leibler DivergenceFeedback

  12. Component-Aware Feedback for Self-Evolving Programs

    Sep 29, 2026Ethan Lin, Jinming Nian, Yi FangEvolutionary SearchSelf-Evolution

  13. Pretraining Latent Information Feedback Transformers with Teacher Supervision

    Sep 29, 2026Dor Tirosh, Ido Amos, Mor GevaTransformer ArchitecturesPretraining

  14. Stochastic World Models for Verifying Vision-Based Neural Feedback Systems

    Sep 29, 2026I. Samuel Akinwande, Mykel J. Kochenderfer, Clark BarrettWorld ModelsGenerative Adversarial Network

  15. ProAct-VLM: Pre-Failure Vision-Language Task Replanning with Continuous Perception Feedback

    Sep 29, 2026Ahmed Nader Ahmed, Omar Moured, Mughni Irfan Mohammed Abdul +2Long-Horizon ManipulationPerception

  16. How Can Recommendation Feedback Evolve Agent Memory?

    Sep 29, 2026Shanwen Mao, Mingming Li, Hao Zhang +4FeedbackClick-Through Rate Prediction

  17. Teaching LLMs to Generate Challenging MILP Instances via Solver Feedback

    Sep 29, 2026Jitin Singla, Parikshit Pareek, Pratik Jawanpuria +1Mixed-Integer ProgrammingHard

  18. LLMs Learn to Evade Latent Monitors from Prior Feedback Alone

    Sep 29, 2026Hugo Lyons Keenan, Christopher Leckie, Sarah ErfaniModel ActivationsEvasion

  19. Action Chunking Proximal Policy Optimization with Feedback Correction

    Sep 28, 2026Sanghyun Hahn, Jonghyun ChoiAction ChunksProximal Policy Optimization

  20. Scouting the Dynamics Gap: Test-Time Policy Adaptation via Action-Outcome Feedback

    Sep 28, 2026Yishu Li, Liyuan Geng, Xinyi Mao +2Robot PoliciesMeta-Learning

  21. Verifier Errors in RLVR: Reward Hacking, Limits of Feedback, and Selective Control

    Sep 28, 2026Christian Moya, Elliott Thornley, Guang LinReinforcement Learning With Verifiable RewardVerifiable Rewards

  22. Inductive Feedback for Mixed-Policy Distillation

    Sep 28, 2026Amir Moeini, Huaijiang Zhu, Daniel Havir +1FeedbackAutoregressive Rollout

  23. How Well Can LLMs Simulate Real Learner Evaluations of Educational Feedback?

    Sep 28, 2026Momoka Furuhashi, Kouta Nakayama, Takashi Kodama +2Large Language Model EvaluationFeedback

  24. Beyond Teacher Assignment: Domain-Normalized Multi-Teacher On-Policy Distillation

    Sep 28, 2026Xin Li, Hao Jiang, Xin Gao +6Aware Heterogeneous Multi-Teacher Multimodal On-Policy DistillationTeacher

  25. UniOPSD: Unifying Outcome and Hindsight Feedback for Agentic Reinforcement Learning

    Sep 28, 2026Zenghuang Fu, Zhaoyang Li, Qiuyuan Ai +8Unsupervised On-Policy Self-DistillationHindsight

  26. Learning Propagation Geometry from Message-Passing Feedback

    Sep 28, 2026Yingxu Wang, Kunyu Zhang, Xinwang Liu +4Graph Neural NetworksGeometric Machine Learning

  27. The Statistical Cost of Causal Discovery with Feedback

    Sep 28, 2026Sunmin Oh, Seungsu Han, Gunwoong ParkCausal Discovery MethodsCausal

  28. RewardExplainer: Learning Reward Model Explanations from Counterfactual Preference Feedback

    Sep 27, 2026Jingyi He, Nier Wu, Shuang Liu +3Progress Reward ModelingExplainable AI Methods

  29. Feedback Makes Perfect: A Closed-Loop Framework for NL-to-STL Translation

    Sep 27, 2026Bowen Ye, Xiang YinSignal Temporal LogicNatural Language

  30. TaskIR: Task-Driven Image Restoration via Degradation Adaptation and Task Feedback

    Sep 25, 2026Yanjie Tu, Qingsen Yan, Axi Niu +4Image RestorationRestoration

  31. SciWalker: Synthesizing Scientific Coding Problems with Operator Graphs and Execution Feedback

    Sep 24, 2026Chenxi Li, Wenxuan Zeng, Yun Luo +4Code GenerationLarge Language Model Workflows

  32. A Risk-Adaptive and Evidence-Constrained Framework for Generative AI Feedback in Programming Education

    Sep 24, 2026Shihao WangArtificial Intelligence EducationFeedback

  33. Learning Collective Dynamics with Differentiable Gaussian Representations

    Sep 23, 2026Jianxiang Ma, Mingfu Zhang, Xiaocui Yang +3Learning DynamicsCollective Behaviors

  34. Exact Feedback Is Not Control: Evaluating Text-based Closed-Loop Revision in LLMs

    Sep 23, 2026Haitong Jiang, Chunlin Liu, Yile Wang +1FeedbackReproducibility

  35. RL Starts before RL: On Policy Distillation for Better Reinforcement Learning

    Sep 23, 2026Shuai Dong, Yongfu Zhu, Yuqi Xu +26Offline Reinforcement LearningFeedback

  36. Evaluating Feedback Focus and Pedagogical Adaptivity in LLM-Generated Feedback on Student Writing

    Sep 23, 2026Norah Almousa, Shayan Peyghambari Oskoui, Raquel Coelho +3Feedback

  37. Discover, Falsify, Revise: Auditing Input-Use Claims from Source Code to Predictive Contribution in Agent-Discovered Cell Models

    Sep 23, 2026Mengran Li, Bo Li, Chengyang Zhang +3Virtual CellModel Auditing

  38. Experts Rise Where LLMs Disagree: Using Cross-Model Disagreement to Target Expert Effort in LLM Codebook Revision for Large-Scale Annotation

    Sep 22, 2026Zeyu He, Zhuqian Zhou, Kirk Vanacore +2Automatic LabellingFeedback

  39. MICRO: Multi-Fidelity Active Search for Severe Error Discovery

    Sep 22, 2026Orlando Leone, Niclas Pokel, Pehuén Moure +2FeedbackDiscovery

  40. Learning Neural Feedback Linearization for Data-driven Systems via Augmented Lagrangian

    Sep 21, 2026Lakshmi Priya P. K., Andreas SchwungRobust ControlClosed-Loop Feedback

  41. DENSE: Distilling Agent Trajectories into Evidence-Grounded Shortcut Trees for Self-Refinement

    Sep 18, 2026Siyuan Liu, Fan Yu, Dongyu Ru +5Self-Improving AgentsRetrying

  42. E-AVI: Evidence-Grounded Multimodal Assessment for Automated Video Interviews

    Sep 17, 2026Haoshen Wang, Dongbo Che, Zeyi Xie +3Multimodal EvaluationFine-Grained Video Understanding

  43. I code or AI code: A comparative evaluation of AI-rated scores in classroom observations

    Sep 16, 2026Y. Fong, J. Xiang, T. Y. D. Chan +2ClassroomsComputerized Adaptive Testing

  44. Interactive Memory Learning for Long-Term Conversations

    Sep 15, 2026Cai Ke, Jiangyue Yan, Han Zhang +5Long-TermFeedback

  45. PaperDoctor: Evidence-Grounded and Actionable Feedback for Scientific Papers in Progress

    Sep 15, 2026Kevin Qinghong Lin, Siyuan Hu, Pan Lu +14Peer ReviewReviewer

  46. The Role of Implicit and Explicit Demographic Signals in Large Language Model-based Student Assessment

    Sep 15, 2026Donya Rooein, Luca Benedetto, Dirk HovyLarge Language Model BiasComputerized Adaptive Testing

  47. AlgoEvo: Self-Evolving Agentic Search for Automated Algorithm Discovery

    Sep 14, 2026Junhao Qiu, Qinglong Hu, Ji Cheng +3Evolutionary SearchSelf-Evolving Agents

  48. VisInteract: Towards Dynamic Interactive Text-to-Visualization under Imperfect Queries

    Sep 14, 2026Wenxin Xu, Jinwei Lu, Hwanhee Kim +4InteractivityQueries

  49. RoofLang: Enabling AI-Driven Architecting of LLM Inference Systems

    Sep 14, 2026Ziyue Yang, Yuting Jiang, Lei Qu +1LLM Inference OptimizationDeepseek

  50. What Drives Recovery in Agentic Text-to-Cypher? LAST-CQ: An LLM Agent Self-Refinement Framework

    Sep 14, 2026Ioannis Prokopiou, Athanasios Aidinis, Panagiotis-Christos Kyrmpatsos +1Text2CypherLarge Language Model Agents

  51. When Greedy Sampling Explores: KL-Regularized Contextual Bandits without Eluder-Dimension Dependence

    Sep 11, 2026Zichen Wang, Haoyang Hong, Huazheng WangContextual Bandit FrameworkKullback-Leibler Regularization

  52. Preference Optimization with LALM Feedback for Continuous Autoregressive Non-Verbal Vocalization Generation

    Sep 10, 2026Jingbin Hu, Qirui Zhan, Yuang Cao +7Preference LearningFeedback