Quantized

Latest papers 75

All topics
CardsList
  1. Analysis of Quantized and Efficiently Adapted Protein Language Models

    Sep 30, 2026Ilan Yaniv Zeisler, Sebastian Clancy, Pouriya Bayat +8Large Language Model QuantizationLanguage Modeling

  2. On the Relationship between Model Quantization and Model Inversion Attacks

    Sep 30, 2026Rongke Liu, Youwen ZhuQuantizedInverse Problem

  3. ShamAN-Q: Shampoo Augmented NanoQuant for Sub-1-bit LLM Weights

    Sep 29, 2026Jonathan Mei, Sang Hyub Kim, Oliver Knitter +2Large Language Model QuantizationQuantized

  4. Optimizing the Phi-2 Small Language Model for Real-time Chatbot Applications Using Parameter-Efficient Fine-Tuning (PEFT) with QLoRA Quantization

    Sep 27, 2026PhanTan Khanh Nguyen, Ashfaq Ali Shafin, Khandaker Mamun AhmedLarge Language Model QuantizationSmall Large Language Models

  5. The Undetected Damage of Quantization on Retrieval and How to Fix It

    Sep 21, 2026Luca Zhou, Alessandro Zirilli, Daniele Solombrino +2QuantizedFull-Precision Performance

  6. Predict Before You Deploy: Offline Prediction of Quantization-Induced Task Degradation for World Action Models

    Sep 16, 2026Jiuyi Xu, Jinjia Guo, Meida Chen +2QuantizedWorld Models

  7. QEMScore: How Much Does the Measurement Add to Learned Quantum Error Mitigation?

    Sep 15, 2026Yue Zhao, Huayue Gu, Yushun Dong +1Quantum Error CorrectionEqual Error Rate

  8. Efficient AI Model Deployment Using Quantization Analysis Tool

    Sep 14, 2026Dwith Chenna, Kanishka MacherlaQuantizedArtificial Intelligence Deployment

  9. Why Does Post-Training Quantization Work?

    Sep 10, 2026Yuxiang Chen, Michael Beyer, Jun Zhu +1Post-Training QuantizationQuantized

  10. A Note on Scaling in Randomly Rotated Quantization and Its Connection to the CDEF +1 Pythagorean Relation

    Sep 8, 2026Uri ErezQuantizedScaling

  11. KBBQ: A Predictive Noise Law and the Limits of Spectrum Flattening in FP4 Quantization

    Sep 8, 2026Lexington Whalen, Yuki Ito, Ryo SakamotoQuantizedQuantizer

  12. Quantization Degradation in Large Language Models: A Signal-Noise Perspective

    Aug 8, 2026Chenxi Zhou, Pengfei Cao, Jinyu Ye +5Large Language Model QuantizationPost-Training Quantization

  13. Which Decisions Low-Bit Quantization Breaks, and How to Predict Them

    Aug 6, 2026Zekun Wu, Swati Dhiman, Adriano KoshiyamaQuantizedShrink

  14. SSTQ:Privacy-Preserving Vector Quantization via Subsampled Stochastic TurboQuant

    Aug 5, 2026Adel Javanmard, David P. Woodruff, Vahab MirrokniResidual Vector QuantizationDecentralized Optimization

  15. Quantization Effects on Biomedical LLM Reliability

    Aug 4, 2026Anton Rasmussen, Hong QinLarge Language Model ReliabilityLarge Language Model Quantization

  16. VQ-bench: A Composable Vector Quantization Framework

    Jul 31, 2026Ashwin Padaki, Amir Ingber, Edo LibertyResidual Vector QuantizationGradient Quantization

  17. Studying quantization trade-offs for efficient inference deployment in machine translation

    Jul 31, 2026Jim Zhao, Sohir Maskey, Koen Oostermeijer +2Large Language Model QuantizationLLM Inference Optimization

  18. Approximate reservoir computing with a semiconductor laser for reducing energy consumption

    Jul 25, 2026Tatsuki Ito, Kazutaka Kanno, Satoshi Kawakami +1Reservoir ComputingReservoir

  19. Same Predictions, Different Reasons: The Effect of Quantization on Model Explanations

    Jul 24, 2026Kazi Kamruzzaman Rabbi, Md. Zami Al Zunaed Farabe, M. Sohel RahmanPost-Training QuantizationQuantized

  20. QuantiBias: Benchmarking Quantization-Induced Bias in LLMs

    Jul 23, 2026Emilio FerraraLarge Language Model BiasLarge Language Model Quantization

  21. Beyond Independent Optimization: Compression, MoE Routing, and Quantization Interactions in Multimodal Edge Intelligence

    Jul 23, 2026Jay Gor, Karm Dave, Akshita Abrol +3Multimodal LearningIntelligent Edge

  22. Quantize with Confidence? An Empirical Study of Quantization for Code Generation

    Jul 15, 2026Saima Afrin, Md. Zahidul Haque, Antonio MastropaoloQuantizedCode Generation

  23. Efficient Tuning Before Low-Bit Post-Training Quantization for Stochastic Gradient Descent-optimized Models

    Jul 13, 2026Peng Xia, Junbiao Pang, Muhammad Ayub SabirPost-Training QuantizationQuantized

  24. A Symbolic Neural CPU for Quantization-Simulated Writeback and Interpretable Program Execution

    Jul 10, 2026Jose Luis Lima de Jesus SilvaNeuro-Symbolic FrameworkQuantized

  25. Lean-QIT: Towards a Formal Infrastructure for Quantum Information Theory

    Jul 10, 2026Chengkai Zhu, Ziao Tang, Guocheng Zhen +6QuantizedInfrastructure

  26. The Illusion of Equivalency: Statistical Characterization of Quantization Effects in LLMs

    Jul 9, 2026Baha Rababah, Cuneyt Gurcan Akcora, Carson K. LeungLarge Language Model QuantizationPost-Training Quantization

  27. Canonical quantization of neurons

    Jul 6, 2026Alexander He, Nana Liu, Mark M. WildeQuantum Neural NetworksHybrid Quantum-Classical Pipeline

  28. A Unified Framework for Quantized and Continuous Strong Lottery Tickets

    Jul 4, 2026Aakash Kumar, Emanuele NataleLotteriesQuantized

  29. Boundary-Aware Quantization: Finite-Scale Decision Geometry of Neural Classifiers

    Jul 1, 2026O. M. KiselevQuantizedDecision Boundaries

  30. On the Expressive Power of Weight Quantization in Large Language Models

    Jun 20, 2026Shao-Qun ZhangLarge Language Model QuantizationQuantized

  31. Fast-TurboQuant: A Multiplier-Free Online Vector Quantization Approach

    Jun 19, 2026Pedro M. R. Pereira, Felipe A. P. de Figueiredo, Rausley A. A. de SouzaResidual Vector QuantizationQuantized

  32. Effective Dimension Governs Generalization in Quantum Kernel Vision Models

    Jun 18, 2026Jian Xu, Delu Zeng, John Paisley +1Quantum KernelsEntanglement

  33. Quantizing Time-Series Models As Dynamical Systems: Trajectory-Based Quantization Sensitivity Score

    Jun 11, 2026Mariya Pavlova, Harrison Bo Hua Zhu, Lidia Vitanova +2QuantizedDynamical Systems

  34. Quality Is Not a Safety Proxy Under Quantization

    Jun 8, 2026Sahil KadadekarQuantizedSafety Benchmarks

  35. SPEAR: A System for Post-Quantization Error-Adaptive Recovery Enabling Efficient Low-Bit LLM Serving

    Jun 4, 2026Hongyuan Liu, Yawei Li, Zhiqiang Que +3Large Language Model QuantizationQuantized

  36. LLM Compression with Jointly Optimizing Architectural and Quantization choices

    Jun 2, 2026Hoang-Loc La, Truong-Thanh Le, Amir Taherkordi +1Large Language Model CompressionLLM Inference Optimization

  37. QVGGT: Post-Training Quantized Visual Geometry Grounded Transformer

    May 29, 2026Zhizhen Pan, Hesong Wang, Huan WangVisual Geometry Grounded Transformer3D Perception

  38. The Quantization Benefits of Residual-Free Transformers

    May 25, 2026Yiping Ji, Mahalakshmi Sabanayagam, Peyman Moghadam +2Transformer Residual StreamsQuantized

  39. Pre-Registering the Detectable Effect: A Paired-MDE Budget for 4-bit Quantization Benchmarks, with a Pilot Audit

    May 25, 2026Zexin Zhuang, Yanhang Li, Zhichao FanQuantizedEffect Sizes

  40. Fermi-Dirac machines as quantizations of neurons

    May 23, 2026Alexander He, Nana Liu, Mark M. WildeQuantum Neural NetworksLfsr-Based Stochastic Leaky Integrate-And-Fire Neuron

  41. LLMs as Noisy Channels: A Shannon Perspective on Model Capacity and Scaling Laws

    May 22, 2026Xu Ouyang, Deyi Liu, Yuhang Cai +5Scaling LawsLarge Language Model Training

  42. When Bits Break Recourse: Counterfactual-Faithful Quantization

    May 16, 2026Chaymae Yahyati, Ismail Lamaakal, Khalid El Makkaoui +1QuantizedLateral String Stability

  43. CAR-SAM: Cross-Attention Reconstruction for Post-Training Quantization of the Segment Anything Model

    May 16, 2026Houji Wen, Jiangyong Yu, Jun Li +1Post-Training QuantizationQuantized

  44. Forgetting That Sticks: Quantization-Permanent Unlearning via Circuit Attribution

    May 14, 2026Saisab Sadhu, Pratinav Seth, Vinay Kumar SankarapuQuantizedExact Unlearning

  45. Rethink the Role of Neural Decoders in Quantum Error Correction

    May 12, 2026Ge Yan, Shanchuan Li, Yuxuan DuQuantum Error CorrectionQuantized

  46. MuonQ: Enhancing Low-Bit Muon Quantization via Directional Fidelity Optimization

    May 12, 2026Yupeng Su, Ruijie Zhang, Ziyue Liu +2QuantizedMuon

  47. PermuQuant: Lowering Per-Group Quantization Error by Reordering Channels for Diffusion Models

    May 10, 2026Yongsen Cheng, Kai Liu, Kaiwen Tao +5QuantizedDiffusion Models