Reweighting

Momentum

7 papers in the last four weeks, up 133% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 44

All topics
CardsList
  1. Does Muon Need Fine-Grained Spectral Shaping?

    Oct 5, 2026Meher Chaitanya, Tianyi Zhou, Aristides GionisMuonReweighting

  2. DMAD: Distribution Matching as Adversarial Distillation for Fast Visual Generation

    Oct 1, 2026Zhengming Yu, Junkun Yuan, Haotian Yang +8Distribution Matching DistillationDataset Distillation

  3. Optimal Transport Reweighting for Robust Learning under Spurious Correlations and Label Noise

    Oct 1, 2026Sung Ho Jo, Seonghwi Kim, Wonsang Yun +1Noisy LabelsReweighting

  4. Rethinking Data Augmentation under Covariate Shift: Invariant-Guided Diffusion and Prototype Reweighting

    Oct 1, 2026Hongyu Cao, Xinyuan Wang, Arun Vignesh Malarkkan +3Data AugmentationCovariate Shift

  5. Reward-Aligned Reweighting for On-Policy Distillation

    Sep 28, 2026Haofeng Xu, Junwei Su, Lansong Diao +2ReweightingProcess-Level Supervision

  6. Rethinking Token Reweighting for SFT: Suppress, Reverse, and Extrapolate Learned Features

    Sep 27, 2026Cunchun Li, Haonan He, Yifan Gao +4Supervised FinetuningReweighting

  7. Local Evidence and Geometric Readout Repair in Trained GNNs

    Sep 22, 2026Nadi Tomeh, Hugo AttaliGnn-Based DetectorsGraph Neural Networks

  8. Remember and Reweight: Enhancing Multi-Agent Debate with Experience Memory and Confidence Estimation

    Sep 3, 2026Xuanfa Jin, Zhijian Ma, Yongcheng Zeng +3Multi-Agent DebateReweighting

  9. PAIR: Pairwise-Aware Inclusion Reweighting for Adaptive Rollout Allocation in RLVR

    Aug 11, 2026Pixel Nomand, Elena Voss, Marcus Hale +1Reinforcement Learning With Verifiable RewardVerifiable Rewards

  10. VADER: Adaptive Debiasing for Hallucination Mitigation in Video Large Language Models

    Aug 9, 2026Dong Xing, Jiaxin Chen, Hang Yang +3Video-Language ModelsVideo Understanding

  11. Recurrent Contrastive Learning for Imbalanced Medical Image Classification

    Aug 4, 2026Zhiyuan Zhu, Xinling Meng, Junxuan Yu +15Medical Image ClassificationContrastive Learning

  12. Bayesian Data Reweighting Improves Multimodal Retrieval for Knowledge-Based Visual Question Answering

    Aug 3, 2026Jingchen Sun, Shaobo Han, Ruiyi Zhang +5Knowledge-Based Visual Question AnsweringMultimodal Retrieval

  13. Rewriting or Reweighting? A Geometric Account in Language Models

    Aug 3, 2026Juntong Wang, Shengkun Yang, Xiyuan Wang +1Behavioral Foundation ModelsModel Activations

  14. Harnessing the Potential of Optimizing Data Mixtures via Bayesian Domain Reweighting

    Jul 30, 2026Xiang Yuan, Kaiqing Lei, Zhenyu Jin +3ReweightingModel Weights

  15. ReDiPPO: Reference-Guided Value Calibration and Discrepancy-Aware Token Reweighting for Mathematical Reasoning

    Jul 30, 2026Zhenrong Zhang, Fei Wu, Jun Du +2Mathematical Reasoning BenchmarksMathematical Reasoning

  16. ReCo: Reweighting GRPO Against Distributional Concentration

    Jul 29, 2026Junoh Park, Junseo Hwang, Wonguk Cho +1ReweightingMathematical Reasoning Benchmarks

  17. Chaos Is a LADDER: Domain Generalization Beyond Invariance via Reweighting

    Jul 29, 2026Yuhang Jiang, Fengchuan Zhang, Sanguo Zhang +1Multimodal Domain GeneralizationReweighting

  18. Online Variance Reduction for Domain Adaptation on Streaming Data

    Jul 22, 2026Andrea NapoliVariance ReductionDomain Adaptation

  19. NFTR: From Provable Mode-Averaging to Geodesic Subgoal Selection in Offline Goal-Conditioned RL

    Jul 8, 2026Erdemt Bao, Xing Lei, Jun Chen +2Goal-Conditioned Reinforcement LearningReweighting

  20. CenSynCMB: Centre Maps and Physics-Guided Synthesis for Microbleed Detection

    Jul 6, 2026Lucas He, Hanyuan Zhang, Krinos Li +7LesionPhysics-Guided Machine Learning

  21. Target-Guided Selective Reweighting for Physics-Informed Neural Network Inverse Problems: A Transfer Learning Approach

    Jul 6, 2026Qian Hu, Bin Fan, Yao Xiao +2Parametric Physics-Informed Neural NetworkInverse Problem

  22. Robust Trajectory Distillation: Hybrid Reweighting Meets Teacher-Inspired Targets

    Jun 29, 2026Kaifeng Chen, Lechao Cheng, Jiyang Li +6Diffusion-Based Dataset DistillationDataset Distillation

  23. Sample-efficient Transfer Reinforcement Learning via Adaptive Reward Shaping and Policy-Ratio Reweighting Strategy

    Jun 25, 2026Wenjie Huang, Yang Li, Jingjia Teng +6Potential-Based Reward ShapingOffline Reinforcement Learning

  24. Beyond Monotonic Progress: Retry-Supervised Value Learning for Robot Imitation

    Jun 23, 2026Xinyao Qin, Junjie Lu, Kaixin Wang +7ImitationValue Functions

  25. Neural Architecture Search of Sample Reweighting Networks for Complex Distribution Shift

    Jun 22, 2026Keisuke Sugawara, Kento Uchida, Shinichi ShirakawaReweightingNeural Architecture Search

  26. GD2^2PO: Mitigating Multi-Reward Conflicts via Group-Dynamic reward-Decoupled Policy Optimization

    Jun 15, 2026Haotian Liu, Yihao Liu, Jingwei Ni +11Offline Reinforcement LearningReweighting

  27. TANDEM: Bi-Level Data Mixture Optimization with Twin Networks

    Jun 3, 2026Jiaxing Wang, Deping Xiang, Jin Xu +9Mixture ModelsReweighting

  28. TIAR: Trajectory-Informed Advantage Reweighting for LLM Abstention Learning

    May 25, 2026Muyu Pan, Shu Zhao, Nan Zhang +4Large Language Model ReliabilityReweighting

  29. GEAR: Granularity-Adaptive Advantage Reweighting for LLM Agents via Self-Distillation

    May 12, 2026Sijia Li, Yuchen Huang, Zifan Liu +7Credit AssignmentSelf-Distillation Framework

  30. Let the Target Select for Itself: Data Selection via Target-Aligned Paths

    May 10, 2026Huitao Yang, Hengzhi He, Tung Sum Thomas Kwok +1Alignment-Aware SelectionAdaptive Sampling

  31. CredibleDFGO: Differentiable Factor Graph Optimization with Credibility Supervision

    May 7, 2026Liang Qian, Penggao Yan, Penghui Xu +1Global Navigation Satellite SystemFactor Graphs

  32. Meta Additive Model: Interpretable Sparse Learning With Auto Weighting

    Apr 22, 2026Xuelin Zhang, Xinyue Liu, Lingjuan Wu +1Generalized Linear ModelReweighting

  33. Rethinking Data Curation in LLM Training: Online Reweighting Offers Better Generalization than Offline Methods

    Apr 19, 2026Wanru Zhao, Yihong Chen, Yuzhi Tang +6Data-CurationLarge Language Model Training

  34. Beyond Logit Adjustment: A Residual Decomposition Framework for Long-Tailed Reranking

    Apr 2, 2026Zhanliang Wang, Hongzhuo Chen, Quan Minh Nguyen +2RerankingLogit Lens

  35. RapidUn: Influence-Driven Parameter Reweighting for Efficient Large Language Model Unlearning

    Dec 4, 2025Guoshenghui Zhao, Huawei Lin, Weijie ZhaoLarge Language Model UnlearningReweighting

  36. Fine-Tune, Then Rectify

    Nov 23, 2025Zikun Ye, Jinglong Zhao, Lei WangModel Fine-TuningReweighting

  37. A Compositional Kernel Model for Feature Learning

    Sep 17, 2025Feng Ruan, Keli Liu, Michael JordanKernel Ridge RegressionKernel Method