Hindsight

Momentum

10 papers in the last four weeks, against 1 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 42

All topics
CardsList
  1. Self-Retrospection Distillation: Turning Post-hoc Experiences into Prior Foresight

    Oct 6, 2026Haoxiang Zhang, Qinglin Chen, Hiroaki Hayashi +9HindsightUnsupervised On-Policy Self-Distillation

  2. NextMe-800: Anticipating Personal Behavior from Months of Egocentric Video

    Oct 1, 2026Zhaoxu Meng, Yiming Sun, Mingyuan Gao +5AnticipateEgocentric Dataset

  3. ReLiveGym: Evaluating Long-Lived Agents over Weeks of Replayed Reality

    Sep 30, 2026Xisen Jin, Jingheng Li, Zhenglun Chen +2Long-Horizon AgentsLong-Term Agent Memory

  4. Learning When and How to Intervene: A Hindsight-Distilled Sentinel for Coding Agents

    Sep 30, 2026Jiangrui Zhao, Chenglong Li, Meng Zhang +1Coding AgentsHindsight

  5. When Should Agents Check External State? Budgeting Observations for Stored Intentions

    Sep 29, 2026Zhengkun Di, Bin Shi, Kai Sun +2Token Budget AllocationLong-Term Agent Memory

  6. GraphHCA: Closed-Form Hindsight Credit Assignment for Long-Horizon LLM Agents

    Sep 28, 2026Haodong Zhu, Yangyang Ren, Changbai Li +4Group-Based Reinforcement LearningCredit Assignment

  7. ECHO: Event-Augmented Context with Hindsight and Outlook for Wrist-Only Manipulation

    Sep 28, 2026Xinyue Wang, Yicheng Jiang, Zesen Gan +8WristCamera Control

  8. UniOPSD: Unifying Outcome and Hindsight Feedback for Agentic Reinforcement Learning

    Sep 28, 2026Zenghuang Fu, Zhaoyang Li, Qiuyuan Ai +8Unsupervised On-Policy Self-DistillationHindsight

  9. Decision-Sufficient State Representations: Measuring and Reducing Write-Time Regret

    Sep 26, 2026Bingyu Shen, Boyang LiHindsightLarge Language Model Agents

  10. On Preference Coverage Collapse from Hindsight Relabeling in Multi-Objective Reinforcement Learning

    Sep 22, 2026Baptiste Bonin, Caro Strickland, Audrey DurandMulti-Objective Reinforcement LearningHindsight

  11. Same Outcome, Different Readout: What Does a Steerable Valence Direction in LLMs Represent?

    Sep 19, 2026Weihan Li, Xinlei Chen, Yuhan Song +2ReadoutLinear Activation Steering

  12. Trajectory-Relative Hindsight Distillation for Agentic Reinforcement Learning

    Aug 7, 2026Haoyu Zheng, Yun Zhu, Qing Wang +1Agentic Reinforcement LearningHindsight

  13. The Next Screenshot Knows: Gated Hindsight Distillation for Mobile GUI Agents

    Aug 6, 2026Weiwei Li, Junzhuo Liu, Tong Chu +2Graphical User Interface AgentsHindsight

  14. When History Lies: Evaluating and Improving Tool Use under Misleading Multi-Turn Histories

    Aug 6, 2026Xiaoqing Wu, Xingyu Fan, Feifei Li +1HistoryHindsight

  15. TurnSight: Turn-Level Hindsight Self-Distillation for Tool-Integrated Reasoning

    Aug 4, 2026Changle Qu, Sunhao Dai, Hengyi Cai +4HindsightOffline Reinforcement Learning

  16. HindSearch: Trajectory-Level Hindsight Critique for Search-Augmented Reinforcement Learning

    Aug 3, 2026Haowei Liu, Jiamian Wang, Hsin-Tai Wu +2HindsightSearch Agents

  17. SERL-SQL: Selective Hindsight Distillation for Text-to-SQL Reinforcement Agentic Learning

    Aug 1, 2026Tao Liu, Tao Feng, Xiangheng Li +9Text-To-SqlSql

  18. H2^2SD: Hybrid Hindsight Self-Distillation

    Jul 21, 2026Qiye Cai, Yichuan Ma, Peiji Li +6Reinforcement Learning With Verifiable RewardHindsight

  19. Bridging the Information Gap: Semantic Densification and Hindsight Distillation for Cold-Start Prediction

    Jul 19, 2026Hao Duong Le, Yifei Gao, Huan Li +4Cold-StartDataset Distillation

  20. Global Merger-Arbitrage Forecasting with Language Models

    Jul 10, 2026Hinal Jajal, Michal Mucha, Charles Sweat +3Large Language Model ForecastingData-Driven Forecasting

  21. Learning from Hindsight for VLA Reinforcement Learning

    Jul 10, 2026Iris Xu, Sunshine Jiang, John Marangola +2Hindsight

  22. Path-level Hindsight Instructions for Semantic Exploration in Vision-Language Navigation

    Jul 2, 2026Sung June Kim, Sangpil Kim, Honglak LeeVision-Language NavigationHindsight

  23. Empowering GUI Agents via Autonomous Experience Exploration and Hindsight Experience Utilization for Task Planning

    Jun 25, 2026Tianyi Men, Zhuoran Jin, Pengfei Cao +3Large Language Model PlanningMultimodal Agents

  24. HiMPO: Hindsight-Informed Memory Policy Optimization for Less-Entangled Credit in Long-Horizon Agents

    Jun 15, 2026Jiangze Yan, Yi Shen, Wenjing Zhang +5Long-Horizon AgentsLong-Term Agent Memory

  25. Localizing Credit at the Divergence: Path-Conditioned Self-Distillation for LLM Reasoning

    Jun 14, 2026Yu Li, Shu Hong, Tian LanUnsupervised On-Policy Self-DistillationOnline-Policy Distillation

  26. HERO: Hindsight-Enhanced Reflection from Environment Observations for Agentic Self-Distillation

    Jun 10, 2026Haoran Liu, Yuwei Zhang, Xiyao Li +2Unsupervised On-Policy Self-DistillationHindsight

  27. Goal Sets, Not Goal States: Queryable Robot Goals through Goal-Set Hindsight Relabeling

    Jun 8, 2026Carlos Vélez García, Miguel Cazorla, Jorge PomaresGoal-Conditioned Reinforcement LearningSubgoals

  28. ZipRL: Adaptive Multi-Turn Context Compression with Hindsight Response Replay

    May 27, 2026Zhexin Hu, Li Wang, Xiaohan Wang +4Data Compression MethodsHindsight

  29. What and When to Distill: Selective Hindsight Distillation for Multi-Turn Agents

    May 19, 2026Xiaozhe Li, Tianyi Lyu, Yang Li +6HindsightFeedback

  30. Hindsight Hint Distillation: Scaffolded Reasoning for SWE Agents from CoT-free Answers

    May 12, 2026Shengjie Wang, Guanghe Li, Zonghan Yang +1HindsightLong-Horizon Agents

  31. Auditing Marketing Budget Allocation with Hindsight Regret

    Apr 28, 2026Nilavra Pathak, Olivier Jeunen, Eric LambertToken Budget AllocationModel Auditing

  32. HEAL: Hindsight Entropy-Assisted Learning for Reasoning Distillation

    Mar 11, 2026Wenjing Zhang, Jiangze Yan, Jieyun Huang +7HindsightCurriculum

  33. From Hindsight to Foresight: Self-Encouraged Hindsight Distillation for Knowledge-based Visual Question Answering

    Nov 14, 2025Yu Zhao, Ying Zhang, Xuhui Sui +4Knowledge-Based Visual Question AnsweringQuestion

  34. CONTHER: Context-Aware Reinforcement Learning for Robotic Manipulation with Sparse Rewards

    Mar 20, 2025Maria Makarova, Qian Liu, Dzmitry TsetserukouGoal-Conditioned Reinforcement LearningRobotic Manipulation

  35. ETHER: Aligning Emergent Communication for Hindsight Experience Replay

    Jul 28, 2023Kevin Yandoka Denamganaï, Daniel Hernandez, Ozan Vardal +2Goal-Conditioned Reinforcement LearningHindsight