Counterfactual Learning

Momentum

9 papers in the last four weeks, against 2 the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 61

All topics
CardsList
  1. When Instructions Retrieve Trajectories: Diagnosing and Mitigating Generalization Failures in VLA Models

    Sep 30, 2026Hung-Jen Chen, Yu-Hsun Hou, Yan-Hong Chen +4Counterfactual LearningImitation

  2. Counterfactual Rollout Replay: Forkable Environments as Free Process Rewards for Software Engineering Agents

    Sep 27, 2026Yuanhao Li, Hongbo Wang, Xuhong Chen +2Counterfactual LearningSoftware Engineering

  3. Towards Eliminating Catastrophic Forgetting in the Curriculum Learning of Math Reasoning Tasks

    Sep 27, 2026Zengyan Yang, Yangyang Wu, Kai Huang +3Catastrophic ForgettingCurriculum

  4. Dual-Frontier: When Can an Agent Trust Its World Model?

    Sep 22, 2026Huatai Zhu, Qiang Chen, Ziqian Kou +5World ModelsCounterfactual Learning

  5. Conditional Tensor Diffusion: Distributional Counterfactual Learning and Inference

    Sep 22, 2026Xinbing Kong, Zeyu Li, Junfan Mao +1Causal InferencesConditional Distribution

  6. OnlineWM: Causality-Aware Active Online Learning for Effective World Modeling

    Sep 20, 2026Yikun Miao, Fangqi Zhu, Quanxin Shou +6Efficient World-Action ModelWorld Models

  7. Counterfactual Reasoning for Robust Visual Question Answering

    Sep 15, 2026Truong-Binh Duong, Thanh-Ngan Tran, Ngoc-Thao Nguyen +1Knowledge-Based Visual Question AnsweringVisual Question Answering Benchmarks

  8. Temporal-Causal Inference for Reinforcement Learning via Automata Learning

    Sep 7, 2026Jan Corazza, Daniil Kaminskyi, Simon Lutz +4Markov Decision ProcessesCounterfactual Learning

  9. CoBRA: Learning Tool-Use Boundaries via Counterfactual Margins

    Sep 1, 2026Wenhao Zou, Xianglong Liu, Wendong Bi +3Large Language Model Tool UseCounterfactual Learning

  10. FACT: Failure-Aware Causal Training for World-Action Models

    Aug 10, 2026Quanquan Peng, Yutong Liang, Rui Yan +2Efficient World-Action ModelAction Generation

  11. GAUGE: Granularity-Adaptive Counterfactual Gating of Evidence for Incomplete Multimodal Classification

    Aug 6, 2026Yunping Shi, En Yu, Kairui Guo +1Multimodal ClassificationCounterfactual Learning

  12. SAFECAST: Robust Failure Detection for VLA Policies with Contrast-Set Training and Calibration

    Aug 4, 2026Harshitha Rajaprakash, Aditeya Prajapati, Rong Xue +2Counterfactual LearningSafer

  13. Robust Counterfactual Policy Optimisation via Nondeterministic Causal Models

    Aug 3, 2026Jessica Lally, Milad Kazemi, Nicola Paoletti +2Counterfactual LearningCausal Modeling

  14. StyleForge: Indoor Furniture Styling by Counterfactual Reasoning in a Hypergraph Field

    Aug 3, 2026Lingwei Dang, Shishuo Shang, Pan Liu +9StylizationCounterfactual Learning

  15. CHILL-Harness: Counterfactual Harness Learning for Efficient Reasoning in Long-Horizon Agents

    Jul 28, 2026Jiarun Fu, Lizhong Ding, Sida Chen +6Long-Horizon AgentsAgent Harness

  16. What do Reward Models Memorize?

    Jul 27, 2026Ivo Verhoeven, Pushkar Mishra, Ekaterina ShutovaProgress Reward ModelingPreference Datasets

  17. Counterfactual Motion Reliability Learning for Robust UAV Tracking

    Jul 25, 2026Yuehai ChenUnmanned Aerial Vehicle DetectionMulti-Object Tracking

  18. Counterfactual Shapley Credit Assignment

    Jul 18, 2026Mingxuan Li, Kai-Zhan Lee, Elias BareinboimCredit AssignmentPotential-Based Reward Shaping

  19. Resist and Update: Counterfactual Report Coordinates for Incentive-Compatible LLMs

    Jul 14, 2026Sen Yang, Yuen-Hei YeungCounterfactual LearningIncentives

  20. Play Like Champions: Counterfactual Feedback Generation in Latent Space

    Jun 30, 2026Andrzej Białecki, Adam Mastalerz, Han ZhouCounterfactual LearningFeedback

  21. An Introduction to Causal Reinforcement Learning

    Jun 23, 2026Elias Bareinboim, Junzhe Zhang, Sanghack LeeCausal InferencesCounterfactual Learning

  22. CFPO: Counterfactual Policy Optimization for Multimodal Reasoning

    Jun 22, 2026Zhangyuan Yu, Wanran Sun, Guangjing Yang +2Multimodal ReasoningRecent Vision-Language Models

  23. Counterfactual learning of new adaptive instructional policies using logged data

    Jun 22, 2026Samuel Girard, Sein Minn, Amel Bouzeghoub +1Contextual Bandit FrameworkCounterfactual Learning

  24. Machine learning modeling of hit-into-play probability and quantification of pitch sequence effects

    Jun 15, 2026Ryota Takamido, Hiroki NakamotoCounterfactual LearningSummary Statistics

  25. NetCause: Counterfactual Learning for Root Cause Analysis in Large-Scale Networks

    Jun 11, 2026Fabien Chraim, Jian Zhang, Dominik Janzing +3Root Cause AnalysisCausal Graph

  26. Counterfactual Transport Flows for Offline Conservative Trajectory Refinement

    Jun 8, 2026Lena Krieger, Xuan Zhao, Zhuo Cao +3Model-Based Reinforcement LearningLong Refinement Trajectories

  27. VeriDrive: Verifiable Counterfactual Supervision for Cost-Efficient Vision-Language Planning

    Jun 5, 2026Zikai Zhang, Hubert P. H. Shum, Toby P. BreckonPhotometric SupervisionHuman Driving

  28. Outsmarting the Chameleon: Counterfactual Decoupling for Tactical OOD Shifts in Live Streaming Risk Assessment

    Jun 1, 2026Yiran Qiao, Jing Chen, Jiaqi Xu +3Out-Of-DistributionStreaming Video

  29. On the Hidden Costs of Counterfactual Knowledge Training in LLM Unlearning

    May 26, 2026Xiaotian Ye, Xiaohan Wang, Mengqi Zhang +1Large Language Model UnlearningCounterfactual Learning

  30. Constraint-Anchored Attribution: Feasibility-Certified Counterfactuals and Bonferroni-PAC Sufficient Subsets for Neural CO Policies

    May 24, 2026Sohaib LafifiNeural Combinatorial OptimizationCredit Assignment

  31. Counterfactually Safe Reinforcement Learning

    May 24, 2026Jingyi Li, Peng Wu, Chengchun ShiCounterfactual LearningOptimality

  32. Learning Spatiotemporal Sensitivity in Video LLMs via Counterfactual Reinforcement Learning

    May 21, 2026Dazhao Du, Jian Liu, Jialong Qin +7Video-Language ModelsSpatio-Temporal Reasoning

  33. SAGE: Scalable Automatic Gating Ensemble for Confident Negative Harvesting in Fraud Detection

    May 19, 2026Sudheer Tubati, Amit GoyalFraud DetectionNegative Results

  34. DEFLECT: Temporal Counterfactual Preference Learning for Delay-Robust Asynchronous VLAs

    May 19, 2026Yixiang Zhu, Yonghao Chen, Zijie Yang +2Counterfactual LearningInference Latency

  35. Form and Function: Machine Unlearning as a Problem of Misaligned States

    May 17, 2026Kennon StewartMachine UnlearningLearning-Augmented Algorithms

  36. COAL: Counterfactual and Observation-Enhanced Alignment Learning for Discriminative Referring Multi-Object Tracking

    May 14, 2026Shukun Jia, Shiyu Hu, Yipei Wang +3Multi-Object TrackingCounterfactual Learning

  37. PROWL: Prioritized Regret-Driven Optimization for World Model Learning

    May 11, 2026Ahmet H. Güzel, Jenny Seidenschwarz, Benjamin Graham +3Video World ModelsAdversarial Training

  38. Overcoming Catastrophic Forgetting in Visual Continual Learning with Reinforcement Fine-Tuning

    May 10, 2026Meng Lou, Hanzhong Guo, Linwei Chen +1Catastrophic ForgettingReinforcement Fine-Tuning

  39. Order-based Rehearsal Learning

    May 6, 2026Yu-Xuan Tao, Tian-Zuo Wang, Zhi-Hua ZhouLayer-Selective Rehearsal StrategyCounterfactual Learning

  40. SpecPL: Disentangling Spectral Granularity for Prompt Learning

    May 6, 2026Jingtao Zhou, Xirui Kang, Feiyang Huang +1Fine-Grained PerceptionVision Encoders

  41. CRAFT: Counterfactual-to-Interactive Reinforcement Fine-Tuning for Driving Policies

    May 6, 2026Keyu Chen, Nanfei Ye, Yida Wang +4Counterfactual LearningReinforcement Fine-Tuning

  42. Unveiling the Backdoor Mechanism Hidden Behind Catastrophic Overfitting in Fast Adversarial Training

    Apr 27, 2026Mengnan Zhao, Lihe Zhang, Tianhang Zheng +2Adversarial TrainingOverfitting

  43. COSAC: Counterfactual Credit Assignment in Sequential Cooperative Teams

    Apr 20, 2026Shripad Deshmukh, Jayakumar Subramanian, Raghavendra Addanki +1Credit AssignmentSoft Actor-Critic

  44. CiPO: Counterfactual Unlearning for Large Reasoning Models through Iterative Preference Optimization

    Apr 17, 2026Junyi Li, Yongqiang Chen, Ningning DingLarge Language Model UnlearningLarge Reasoning Models

  45. Towards Robust Endogenous Reasoning: Unifying Drift Adaptation in Non-Stationary Tuning

    Apr 17, 2026Xiaoyu Yang, En Yu, Wei Duan +1Large Language Model AdaptationMultimodal Large Language Models

  46. Error-Driven Scene Editing for 3D Grounding in Large Language Models

    Nov 18, 2025Yue Zhang, Zun Wang, Han Lin +53D Visual GroundingSpatial Grounding

  47. Did Models Learn Sufficiently? Attribution-Guided Training via Subset-Selected Counterfactual Augmentation

    Nov 15, 2025Yannan Chen, Ruoyu Chen, Wei Wang +6Counterfactual LearningAttention-Guided Training