Gradient

Momentum

28 papers in the last four weeks, up 56% on the four weeks before. 0.3% of all new papers.

Jul 13Week of Sep 28

Latest papers 217

All topics
CardsList
  1. From Gradients to Capabilities: Understanding Multi-Teacher On-Policy Distillation

    Oct 1, 2026Siqi Zhu, Suozhi Huang, Kaixuan Zhang +4Aware Heterogeneous Multi-Teacher Multimodal On-Policy DistillationTeacher

  2. Comparing a gradient boosting algorithm to the GOES FDC for wildfire detection

    Oct 1, 2026Asaf Vanunu, Boaz Nadler, Arnon KarnieliWildfire DetectionXgboost Model

  3. Reinforcement Learning to Accelerate Primal-Dual Hybrid Gradient for Linear Programming

    Oct 1, 2026Jinhwan Sul, Alex Oshin, Evangelos A. TheodorouLinear ProgrammingPrimal-Dual Methods

  4. Least-time Gradient Flow

    Oct 1, 2026Alessandro Betti, Marco Gori, Stefano Melacci +1Wasserstein Gradient FlowsGradient

  5. Backward-State Policy Is Part of the Learning Algorithm

    Sep 30, 2026Shuxiao Xie, Shuyang Xie, Dezhi Ran +2Backward PassesGradient

  6. A Generalizable and Explainable Framework for Synthetic Video Detection Using First-Digit Gradient Statistics

    Sep 30, 2026Sidharth Shanu, Gautam Kumar, Tej SinghAi-Generated Video DetectionDigital Forensics

  7. Learn-Then-Differentiate Gradient Estimation

    Sep 30, 2026Nifei Lin, Qingkai Zhang, L. Jeff HongGradientImplicit Differentiation

  8. Same Loss, Different Gradients

    Sep 30, 2026Ningkang Peng, Xiaoqian Peng, Yifan He +4Differentiable OptimizationGradient

  9. dattri-LLM: A Unified and Efficient Library for Training Data Attribution at LLM Scale

    Sep 30, 2026Shixuan Liu, Tongli Zhou, Junwei Deng +2Large Language Model TrainingLarge Language Models(Llms

  10. Aegis: Generative Gradient Masking for Privacy-Preserving Medical Federated Learning

    Sep 29, 2026Chaoyu Zhang, Shanghao Shi, Heng Jin +3Federated LearningGradient

  11. Unifying Distributional Training for One-Step Visual Generation

    Sep 28, 2026Chi Zhang, Shi Haoyang, Yueyi Liu +9Generative Flow NetworksVisual Generation

  12. ReSPO: Reshaped Sequence Policy Optimization for Gradient Starvation in Off-Policy Learning

    Sep 28, 2026Yihang Chen, Yuanhao Ban, Cho-Jui HsiehOff-Policy LearningReinforcement Learning With Verifiable Reward

  13. Convex Optimization Is Free When Accuracy Is Expensive

    Sep 28, 2026Arthur Paing, Arthur JacotConvex OptimizationFirst Order Oracle Complexity

  14. ORPG: Reconciling Multiple Reward Objectives through Objective-wise Policy Gradients

    Sep 28, 2026Shicheng Fang, Yiwen Zhao, Wenbo Tian +4Reward-Only Policy Optimization VariantsGradient Component

  15. On Parameter Symmetries and Conservation Laws in Gradient Flow

    Sep 28, 2026Khang Nguyen, Guido MontúfarSymmetryGradient

  16. DGS-MLDG: Domain Gradient Surgery Guided Meta-Learning for Domain Generalization in Speech Deepfake Detection

    Sep 27, 2026Siqing Qin, Kong Aik Lee, Youzhi Tu +2Multimodal Domain GeneralizationMeta-Learning

  17. The cost of useful natural gradient updates

    Sep 27, 2026Subhransu S. Bhattacharjee, Dylan Campbell, Rahul ShomeFisher Information MatrixGradient

  18. CompliantWBC: Whole-Body Compliance for Heavy Humanoids via Force Latent Estimation and Residual Impedance Targets

    Sep 27, 2026Tan-Dzung Do, Cuc T. Trinh, Tuan Dat Phuong +4Whole-Body ControlImpedance Control

  19. Temporal Gradient Inversion for Private Trajectory Reconstruction in Embodied Reinforcement Learning

    Sep 24, 2026Sudip Bhujel, Shanghao Shi, Ruiquan Huang +2Gradient-Based AttacksOffline Reinforcement Learning

  20. FairMean: Promoting Fairness in Distributed Learning under Label Poisoning Attacks

    Sep 22, 2026Huigan Zheng, Jiaojiao Zhang, Yongxiang LiuAlgorithmic FairnessBalanced Learning

  21. Gradient Descent with Stochastic Subspaces via Persistence of Memory

    Sep 16, 2026Subhroshekhar Ghosh, Clement Z. Q. Ng, Pierre-Louis Poirion +1Stochastic Gradient DescentGradient Descent

  22. Preservation of Log-Concavity and Convergence of Wasserstein-Fisher-Rao Gradient Flows

    Sep 16, 2026Francesca Romana Crucinio, Sahani PathirajaWasserstein Gradient FlowsLog-Concave Distributions

  23. Online Gradient Computation for Warping Gaussian Process Transformations

    Sep 15, 2026Emilio Ruiz-Moreno, Konstantinos Slavakis, Baltasar Beferull-LozanoGaussian ProcessWasserstein Gradient Flows

  24. Solving Finite-sum Coupled Compositional Optimization via Multi-block-Single-probe Estimator

    Sep 14, 2026Wei Jiang, Sifan Yang, Yibo Wang +2Stochastic OptimizationVariance Reduction

  25. Tackling Failure Modes of PINNs and PIKANs Using Conflict-Free Gradients

    Sep 13, 2026Sidharth S. Menon, Irina Tezaur, Ameya D. JagtapParametric Physics-Informed Neural NetworkGradient

  26. Not All Variables Agree: Reliability-Aware Variable-Wise Gradient Surgery for Multivariate Time-Series Forecasting

    Sep 8, 2026Jinwoo Park, Hyeongwon Kang, Pilsung KangMultivariate Time Series ForecastingLoss Function

  27. TruncGradGS: Improved 3D Gaussian Splatting via Truncated Gradient Updates

    Sep 3, 2026Theo Morales, Nhat-Quynh Le-Pham, Robin Atkins +13D Gaussian3D Gaussian Primitives

  28. Gradients Know What Outcomes Don't: Unlocking Reinforcement Learning for LLM Reasoning with Gradient-Aligned Rewards

    Sep 3, 2026Leqi Zheng, Jinbo Su, Fang Niu +8Reinforcement Learning With Verifiable RewardLLM Reasoning Strategies

  29. CAT-Flow: Curvature-Adaptive sTeps for Flow Matching

    Sep 1, 2026Qinchan Li, Pedro Cisneros-Velarde, Keru Fu +3Contrastive Flow MatchingGenerative Models

  30. The Multiple Timescales of Gradient Descent on the Edge of Stability: A Perturbative Derivation of the Central Flow

    Sep 1, 2026Raphaël BerthierGradient DescentGradient

  31. Adapting Without Gradients: Affine Statistics Transport and What Its Certificate Can Tell You

    Aug 31, 2026Salim Khazem, Ibrahim Mohamed SerouisTest-Time AdaptationFrozen Backbone

  32. Hard-ReLU Gradient Descent Selects an Event-Free Sensitivity Limit

    Aug 31, 2026Xiaoyang Li, Runni ZhouGradientLocal Curvature

  33. Fine-Tuning Low-Bit Models with Gradient in Quantized Code Space

    Aug 31, 2026Shiguang Wu, Zhouchen Lin, Quanming YaoModel Fine-TuningSurrogate Gradient

  34. Reciprocity Separates Gradient Flow from Rotation in Conservative Physical Learning

    Aug 31, 2026Ruiwu Niu, Xiaowen Bi, Michaël Antonie van WykWasserstein Gradient FlowsGradient

  35. GMTS: Gradient Magnitude-based Token Selection Improves RLVR Training for LLM Reasoning

    Aug 31, 2026Outongyi Lv, Yuanwei Zhang, Xiaoqun ZhangToken-Level EntropyReinforcement Learning With Verifiable Reward

  36. LoRA-GA2^2: Low Rank Adaptation with Multi-step Gradient Adaptive Alignment

    Aug 20, 2026Haonan He, Xinyue FanMulti-LoraModel Fine-Tuning

  37. Activation-Keyed Momentum: An Anisotropic Momentum Update via the Delta Rule

    Aug 19, 2026Euijin Hong, Guannan QuMomentum Stochastic Gradient DescentMomentum

  38. Fine-Tuning Generative Models for Extreme Events via CVaR-Penalized Wasserstein Gradient Flows

    Aug 12, 2026Thejani Gamage, Hyemin Gu, Zhizhen Zhang +3Long-Tailed DistributionWasserstein Gradient Flows

  39. Learning Gaussian Structure: Intervention-Guided Density Control for Feed-Forward Driving Reconstruction

    Aug 11, 2026Hang Li, Jiahe Li, Meiying Gu +3Feed-Forward 3D GaussianGaussian Primitives

  40. Why Post-Norm Transformers Collapse: Attention Amplification and Gradient Repair Failure

    Aug 10, 2026Xingjian Wang, Qingyu Han, Xiaodong Luo +1Batch NormalizationTransformer Encoder

  41. Density-Functional Excited-State Gradients and Nonadiabatic Couplings on a Consumer GPU from a Contraction-DAG

    Aug 6, 2026Rubén Darío GuerreroDensity Functional TheorySingle Excitation Time History

  42. The Loss Does Not See the Basis, but Adam Does

    Aug 5, 2026Devender SinghLow-Rank StructureAdam

  43. Hard Constraints, Smooth Gradients: Learning Feasible Inventory Policies via Differentiable Projection

    Aug 3, 2026Patrick Helm, Jan-Niklas Doerr, Joren Gijsbrechts +1Mixed-Integer ProgrammingInequality Constraints

  44. QQWorld: Quantile-Quantile Matching for World Model Regularization

    Jul 30, 2026Zhoushun Yu, Xiaoyu Hu, Xiangyu XuLatent World ModelsEfficient Planning

  45. Between Gradient and Natural Gradient: A Continuum of LoRA Initializations

    Jul 28, 2026Dianze Liu, Farshid GhezelbashModel Fine-TuningGradient

  46. Geometry Meets Semantics: Fractional Gradient Stabilization for Semantic-Driven Bounding Box Optimization in Visual Detection Tasks

    Jul 26, 2026Qi Ming, Zheng Zhou, Haitian Yang +4Bounding BoxGeometric Machine Learning

  47. Mini-batch Noise Lowers Sharpness via Dominant-Subspace Fluctuations

    Jul 25, 2026Junho So, Dongwook ShinStochastic Gradient DescentSharpness-Aware Minimization

  48. Finite-Time Analysis of the Natural Policy Gradient in Finite-Horizon Markov Decision Processes

    Jul 25, 2026Asha Barua, Sajad KhodadadianPolicy GradientMarkov Decision Processes

  49. Pipelined Gradient Coding

    Jul 22, 2026Xian Su, Jun LiPartitioningGradient