Model Weights

Momentum

21 papers in the last four weeks, up 133% on the four weeks before. 0.2% of all new papers.

Jul 13Week of Sep 28

Latest papers 127

All topics
CardsList
  1. StagQ: Constraint-Driven Multi-Precision Weight Quantization for LLMs

    Oct 5, 2026Zhe Wei, Mengqi Guo, Yuan Yuan +3Model Weights

  2. Understanding the Weight Averaging Mechanism in LLM Training for Post-Training Quantization

    Oct 4, 2026Hanzhang Wang, Tianqi Shen, Zonglin Liu +3Model Weights

  3. Removing spurious minima for planar features by skip connections

    Oct 1, 2026Jakob Paul Zimmermann, Moritz Grillo, Andrei Balakin +1Flat MinimaSkip

  4. AIR-LLM: Broadcasting AI Weights over Radio for Memory-Free Edge LLM Inference via RF Computing

    Sep 30, 2026Zhihui Gao, Tingjun Chen, Dirk EnglundLLM Inference OptimizationEdge Devices

  5. Is Weight Tying Still Beneficial for Decoder-Only LLMs in Private Settings Under DP-SGD?

    Sep 30, 2026Razan El Mais, Ali Chehab, Ibrahim Issa +1Model WeightsStochastic Gradient Descent

  6. A Tilted Bowl Is Not a Slippery Slope: Compressing Looped Models

    Sep 30, 2026Steven Kolawole, Pearse Jim, Opegbemi M. Busoye +2Compressed ModelModel Weights

  7. JARQ: Joint Alternating Refinement for Quantization

    Sep 29, 2026Xinyu Wang, Sicheng Lyu, Xiao-Wen ChangPost-Training QuantizationLanguage Model Perplexity

  8. ShamAN-Q: Shampoo Augmented NanoQuant for Sub-1-bit LLM Weights

    Sep 29, 2026Jonathan Mei, Sang Hyub Kim, Oliver Knitter +2Large Language Model QuantizationQuantized

  9. Security-Enhanced Seed-Based Weight Quantization for Large Language Models

    Sep 29, 2026Qiuyu Ren, Sudipta Paria, Aritra Dasgupta +1Model WeightsSecure Aggregation

  10. TerMeZO: Ternary Sparse Zeroth-Order Optimization for Fine-tuning BitNet Models at the Edge

    Sep 27, 2026Houssem Sifaou, Prabodh Katti, Bipin Rajendran +1Zeroth-Order OptimizationZeroth-Order

  11. Beyond Scalar Sensitivity: Activation-Aware Mixed-Precision LLM Quantization with Cross-Layer Refinement

    Sep 22, 2026Akihiro Yoshida, Yuma IchikawaMixed-Precision QuantizationLarge Language Model Quantization

  12. Infinite-Parameter LLMs: Generating and Adapting Weights from Live Data

    Sep 16, 2026Jinli Hu, Ross M. Clarke, Yichuan Zhang +1Model WeightsIn-Context Learning

  13. Breaking the 1.58-bit Barrier for Ternary LLMs

    Sep 14, 2026Evangelos Georganas, Alexander Heinecke, Pradeep DubeyLarge Language Model QuantizationModel Weights

  14. Reproducing and Evaluating the Generalizability of Subliminal Learning in Open-Weight Models

    Sep 14, 2026Daan van der Weijden, Nathan Brack, Selene Baez SantamariaModel WeightsTeacher

  15. Structured Transforms for Low-Overhead Quantization of Language Models

    Sep 11, 2026Daria Cherniuk, Alexander Rudikov, Boris Kashin +1Large Language Model QuantizationModel Weights

  16. Stochastically Perturbed Weights: Ensembles from Deterministic Machine-Learning Weather Models

    Sep 8, 2026Simon Adamov, Oliver Fuhrer, Reto Knutti +1Artificial Intelligence Weather ModelsModel Weights

  17. Online Self-Weighted Fine-Tuning

    Sep 1, 2026Haiquan Wen, Yiwei He, Bei Peng +1Model Fine-TuningModel Weights

  18. FAMPWQ: Fisher Information-based Adaptive Mixed Precision Weight Quantization for Effective LLM Inference

    Aug 24, 2026Gongwei Lee, Ji Liu, Juncheng Jia +1Mixed-Precision QuantizationLLM Inference Optimization

  19. Activation-Weighted Seeded Residual Coding for Low-Bit LLM Weight Repair

    Aug 24, 2026Zehao Liu, Chuangchuang Fang, Yang RenLarge Language Model QuantizationModel Weights

  20. In-Cell Learning: Language Models That Update Their Own Weights in Sequence Without Changing the File They Ship

    Aug 21, 2026Zifeng Liu, Yaxin Lu, Xuanhan Wu +6Model WeightsFull-Precision Performance

  21. Training Leaves Traces: Centered Residual Signatures for Language Model Lineage Verification

    Aug 14, 2026Aman Singh Thakur, Rayan KhouryModel CheckpointsModel Weights

  22. Reduced Matrix Multiplication: Input-Adaptive Matrix-Product Reduction for LLM Inference

    Aug 13, 2026Zixuan Lan, Yanhong Li, Jiawei ZhouMatrix MultiplicationLLM Inference Optimization

  23. Weightless Fine-Tuning: Personalizing LLMs via Logit-Space Transport

    Aug 11, 2026Bohan Zhang, Anqi Ni, Yixin Wang +1Model Fine-TuningLogit Lens

  24. LegoLM: Structured Weight Sharing for Large Language Models

    Aug 9, 2026Joseph BinghamLarge Language Model CompressionModel Weights

  25. Quantization Degradation in Large Language Models: A Signal-Noise Perspective

    Aug 8, 2026Chenxi Zhou, Pengfei Cao, Jinyu Ye +5Large Language Model QuantizationPost-Training Quantization

  26. Who Built This Model? Tracing LLM Lineage via Spectral Fingerprints in Weight Space

    Aug 7, 2026Yiwei Chen, Bingqi Shang, Sijia LiuModel WeightsLineages

  27. ELMZip: Onboard Satellite Image Compression via Extreme Learning Machines for Efficient Downlink

    Aug 7, 2026Woojin Cho, Junghwan Park, Sangcheol Sim +3Hyperspectral ImagePower Allocation

  28. Wan-Animate-2: Pushing the Application Boundaries of Character Animation

    Aug 6, 2026Guangyuan Wang, Li Hu, Dechao Meng +11Latent MotionDiffusion Transformers

  29. Muon Meets Mamba: Spectral Optimization for State Space Models

    Aug 4, 2026Arslan Battalov, Karim Kramin, Alexander Markotenko +1MuonState Space Models

  30. Sparse Weight Decomposition for Efficient Circuit Extraction

    Aug 4, 2026Chuanhao Yan, Xuhan Huang, Yawen Duan +4Transformer ArchitecturesModel Weights

  31. Not the Dimension, the Norm: What Matters in Gradient-Free Weight Perturbation of Language Models

    Aug 3, 2026Taeyeong Kim, Ahhyun Kim, TaeHyeon Kim +1Model WeightsNorm

  32. Harnessing the Potential of Optimizing Data Mixtures via Bayesian Domain Reweighting

    Jul 30, 2026Xiang Yuan, Kaiqing Lei, Zhenyu Jin +3ReweightingModel Weights

  33. Kimi K3: Open Frontier Intelligence

    Jul 27, 2026Kimi Team, Tongtong Bai, Yifan Bai +399Qwen3Intelligence

  34. CoG-Guided Weight Correction for Fault-Tolerant Deep Neural Networks

    Jul 17, 2026Bahram Parchekani, Samira Nazari, Ali Azarpeyvand +3Model WeightsNeural Network

  35. Co-Harness: Co-Evolving Harnesses and Model Weights for LLM Agents

    Jul 17, 2026Zhengyu Chen, Teng Xiao, Huaisheng Zhu +3Agent HarnessLarge Language Model Agents

  36. Counterfactuals for Feature-Weighted Clustering

    Jul 16, 2026Richard J. Fawley, Renato Cordeiro de AmorimClusteringCounterfactual Explanation

  37. LIGO-PINN: Learned Initialization via Gated Optimization to Alleviate Convergence Failures in Physics Informed Neural Networks

    Jul 15, 2026Nilay Anurag, Shital Adhikari, Taniya Kapoor +1Parametric Physics-Informed Neural NetworkPartial Differential Equations

  38. Weight-Adjusted Gradients Reveal Parameter Importance and Failure Modes in LLMs

    Jul 12, 2026Shrestha Datta, Hongfu Liu, Anshuman ChhabraModel WeightsGradient

  39. Reliability-Aware Ensemble Classification Under Class Imbalance: A Calibration Study on Liquid-Based Cervical Cytology

    Jul 10, 2026Nisreen Albzour, Sarah S. LamCancer DetectionImbalanced Classification

  40. Super Weights in LLMs and the Failure of Selective Training

    Jul 9, 2026Shreyas Subramanian, Adewale Akinfaderin, Akarsha SehwagModel WeightsLow-Rank Structure

  41. ManifoldFlow: SPD-Relaxed Stiefel Layers with Learnable Singular Spectrum

    Jul 5, 2026Haiwen Yi, Xinyuan SongOrthogonalityModel Weights

  42. Decentralized Aggregation of LLM Predictions via Wagering Mechanisms

    Jul 5, 2026Yuhong Luo, David M. Pennock, Xintong WangDecentralized LearningBetting

  43. Harness-Aware Self-Evolving: Co-Evolving Model Weights, Harness, and Task Solutions

    Jul 4, 2026Haochen Luo, Yi Huang, Sichun Luo +5Evolving HarnessSelf-Evolution

  44. Observable- and Positional-Encoding-Dependent Symmetry Readout from Neural Network Weights

    Jul 3, 2026Naoya Chiba, Satoshi Sugiyama, Yuki UranishiSymmetryModel Weights