Process-Level Supervision

Momentum

33 papers in the last four weeks, up 200% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 154

All topics
CardsList
  1. Spatial Blindness in Whole-Slide Multiple Instance Learning

    May 17, 2026Xiangyu Li, Ran SuWhole-Slide ImagesMultiple Instance Learning

  2. SADP: Subgoal-Aware Diffusion Policy for Explainable Robots Learned from Foundation Model Generated Demonstrations

    May 16, 2026Site Hu, Takato HoriiDiffusion PoliciesRobot Systems

  3. SceneForge: Structured World Supervision from 3D Interventions

    May 14, 2026Jizhizi Li, Jiayang Ao, Danny Wicks +1Scene ReasoningMultimodal Learning

  4. Hessian Matching for Machine-Learned Coarse-Grained Molecular Dynamics

    May 12, 2026Sanya Murdeshwar, Sanjit Shashi, Kevin Bachelor +3Molecular DynamicsProtein Structure Prediction

  5. StepCodeReasoner: Aligning Code Reasoning with Stepwise Execution Traces via Reinforcement Learning

    May 12, 2026Hao Wang, Rui Li, Lei Sha +1Code GenerationSearch-Augmented Reasoning

  6. Rethinking Supervision Granularity: Segment-Level Learning for LLM-Based Theorem Proving

    May 12, 2026Shuo Xu, Jiakun Zhang, Junyu Lai +2Theorem ProvingProcess-Level Supervision

  7. A Controlled Counterexample to Strong Proxy-Based Explanations of OOD Performance: in a Fixed Pretraining-and-Probing Setup

    May 12, 2026Hongmin LiGeneration ProvenanceOut-Of-Distribution

  8. PathISE: Learning Informative Path Supervision for Knowledge Graph Question Answering

    May 11, 2026Shengxiang Gao, Chao Lei, Jey Han Lau +1Knowledge GraphsQuestion

  9. Modeling Atomic Conformational Ensembles of Proteins via Test-Time Supervision of Boltz-2 on Cryo-EM Density Maps

    May 11, 2026Jay Shenoy, Miro Astore, Axel Levy +3Cryo-Electron MicroscopyConformational Ensembles

  10. Think-with-Rubrics: From External Evaluator to Internal Reasoning Guidance

    May 8, 2026Jiachen Yu, Zhihao Xu, Junjie Wang +1Process-Level SupervisionReasoning Traces

  11. Contrastive Identification and Generation in the Limit

    May 7, 2026Xiaoyu Li, Andi Han, Jiaojiao Jiang +1Contrastive LearningAdversarial Corruption

  12. VISD: Enhancing Video Reasoning via Structured Self-Distillation

    May 7, 2026Hao Lin, Kunyang Lv, Xu Jiang +5Latent Visual ReasoningProcess-Level Supervision

  13. Knowledge-Graph Paths as Intermediate Supervision for Self-Evolving Search Agents

    May 7, 2026Huyu Wu, Jun Liu, Xiaochi Wei +3Self-Evolving AgentsSearch Agents

  14. Self-Induced Outcome Potential: Turn-Level Credit Assignment for Agents without Verifiers

    May 6, 2026Senkang Hu, Yong Dai, Xudong Han +4Credit AssignmentProcess-Level Supervision

  15. Every Step Counts: Step-Level Credit Assignment for Tool-Integrated Text-to-SQL

    May 6, 2026Yaxun Dai, Baolin Sun, Junying Wang +6Text-To-SqlCredit Assignment

  16. A Workflow-Oriented Framework for Asynchronous Human-AI Collaboration in Hybrid and Compute-Intensive HPC Environments

    May 5, 2026Sergio Mendoza, Cedric Bhihe, Natalia Zamora +5High-Performance ComputingHuman-Ai Collaboration

  17. JURY-RL: Votes Propose, Proofs Dispose for Label-Free RLVR

    Apr 28, 2026Xinjie Chen, Biao Fu, Jing Wu +4Reinforcement Learning With Verifiable RewardVerifiable Rewards

  18. Learning to Think from Multiple Thinkers

    Apr 27, 2026Nirmit Joshi, Roey Magen, Nathan Srebro +2LearnabilityChain-of-Thought Reasoning

  19. Can Explicit Physical Feasibility Benefit VLA Learning? An Empirical Study

    Apr 20, 2026Yubai Wei, Chen Wu, Hashem HaghbayanVision-Language-Action FrameworkPhotometric Supervision

  20. ACE: Self-Evolving LLM Coding Framework via Adversarial Unit Test Generation and Preference Optimization

    Apr 17, 2026Yixu Huang, Xinglei Yu, Zhongyu WeiCode GenerationAdversarial Evaluation

  21. Hybrid Decision Making via Conformal VLM-generated Guidance

    Apr 16, 2026Debodeep Banerjee, Burcu Sayin, Stefano Teso +1Large Language Model DecisionsGuidance

  22. BioELX: Context-Aware Cross-lingual Biomedical Entity Linking without Task-Specific Supervision

    Apr 9, 2026Yi Wang, Corina Dima, Liangyu Zhong +1Medical OntologyLife Sciences Research

  23. RAWR: Reward Assignment Without Rollouts in Verifiable Domains

    Mar 18, 2026Corentin Royer, Anna Hedström, Debarun Bhattacharjya +3Process Reward ModelReinforcement Learning With Verifiable Reward

  24. SCRIBE: Structured Mid-Level Supervision for Tool-Using Language Models

    Jan 7, 2026Yuxuan Jiang, Francis FerraroProcess Reward ModelProcess-Level Supervision

  25. Deductive Logic in Language Models: Horizontal vs Vertical Reasoning

    Oct 10, 2025Davide Maltoni, Matteo FerraraDeductionSmall Large Language Models

  26. CPATTA: Conformal Supervision Allocation For Active Test-Time Adaptation

    Sep 30, 2025Tingyu Shi, Fan Lyu, Haihua Zhu +2Stable Test-Time AdaptationOnline Conformal Prediction

  27. Neuro-symbolic Weak Supervision: Theory and Semantics

    Mar 24, 2025Nijesh Upreti, Vaishak BelleNeuro-Symbolic FrameworkMultiple Instance Learning

  28. From My View to Yours: Learning Egocentric Cues from Exocentric Video using Privileged Egocentric Supervision

    Jan 10, 2025Dominick Reilly, Manish Kumar Govind, Le Xue +1Egocentric VideoEgocentric Vision

  29. MERIT: Matching Expertise via Rubric-Informed Training for Reviewer Assignment

    Date pendingZixuan Yang, Yibo Zhao, Weicong Liu +1ReviewerTask-Specific Rubrics

  30. A Recipe for Long-Context Reasoning in Large Language Models via On-Policy Optimization and Distillation

    Date pendingMiguel Moura Ramos, Duarte M. Alves, André F. T. MartinsEfficient Long-Context InferenceLong-Context Reasoning