Full-Precision Performance

Momentum

6 papers in the last four weeks, up 100% on the four weeks before. 0.1% of all new papers.

Jul 13Week of Sep 28

Latest papers 42

All topics
CardsList
  1. Stochastic Rounding in Low-Precision Transformer Inference: A Variable-Precision Emulation Study of a Small GPT-2

    Oct 1, 2026Yohan Chatelain, Pablo de Oliveira CastroFull-Precision PerformanceLanguage Model Perplexity

  2. Backward-State Policy Is Part of the Learning Algorithm

    Sep 30, 2026Shuxiao Xie, Shuyang Xie, Dezhi Ran +2Backward PassesGradient

  3. DPS: Dual-Mode Precision LLM Serving with Semi-Unified Memory

    Sep 28, 2026Xuan Truong Nguyen, Tien Son Pham, Tuan Duc Chu +2Graphics Processing Unit MemoryKv-Cache Management

  4. The Undetected Damage of Quantization on Retrieval and How to Fix It

    Sep 21, 2026Luca Zhou, Alessandro Zirilli, Daniele Solombrino +2QuantizedFull-Precision Performance

  5. Radio-Frequency Convolutional Neural Networks

    Sep 16, 2026Zhihui Gao, Shi-Yuan Ma, Yiran Chen +2Edge DevicesNeural Network Inference

  6. In-Cell Learning: Language Models That Update Their Own Weights in Sequence Without Changing the File They Ship

    Aug 21, 2026Zifeng Liu, Yaxin Lu, Xuanhan Wu +6Model WeightsFull-Precision Performance

  7. CurveFP: Co-Designing Numerical Representation and Product Arithmetic for Language Models

    Aug 8, 2026Ye QiaoFull-Precision PerformanceTask Arithmetic

  8. When Can Depth Replace Precision? A Resource Theory of Quantized Neural Computation

    Jul 25, 2026Mojtaba SoltanalianFull-Precision PerformanceCircuit Depth

  9. Contraction-Gauge Preconditioning for Quantized Matrix Multiplication

    Jul 21, 2026Piyush Sao, Narasinga Miniskar, Pedro Valero-Lara +2Matrix MultiplicationSpectral Preconditioning

  10. The Silent Freeze: Predicting When Low-Precision Training Stops Learning

    Jul 9, 2026Zekai ShangFull-Precision PerformanceFreeze

  11. GeoFP8: Geometry-Aware FP8 Gradient Compression for Distributed LLM Training

    Jul 8, 2026Jieying Wang, Zizhong Wang, Fangru Linghu +3Large Language Model QuantizationLarge Language Model Pretraining

  12. Dithered Gaussian Mechanism for Randomness-Efficient Differential Privacy

    Jul 7, 2026Nikita P. Kalinin, Rasmus PaghStandard Differential-PrivacyRandom

  13. How Should Transformers Encode Numeric Values in Electronic Health Records?

    Jul 1, 2026Maria Elkjær Montgomery, Christian Igel, Mikkel Odgaard +2Electronic Health RecordsTransformer Architectures

  14. Extrapolating from Regularised Solutions for Solving Ill-Conditioned Linear Systems in Machine Learning

    Jun 29, 2026Disha Hegde, Jon Cockayne, Chris. J. OatesSolver IterationsRegularization

  15. ReQAT: Achieving Full-Precision Reasoning Accuracy with 4-bit Floating-Point Quantization-Aware Training

    Jun 14, 2026Janghwan Lee, Sihwa Lee, Jinseok Kim +4Quantization-Aware TrainingFp8

  16. Limitations of Learning Tanh Neural Networks with Finite Precision

    Jun 9, 2026Philipp Grohs, Matěj TrödlerActivation FunctionsNeural Network

  17. Exact equivariance, kept through training, buys zero-shot generalisation across the symmetry group

    Jun 2, 2026Hongbo WangRotation EquivarianceEquivariance

  18. ScaleSweep: Accurate NVFP4 Post-Training Quantization of LLMs via Block Scale Initialization

    May 30, 2026Li Lin, Xiaojun WanFp8Full-Precision Performance

  19. GNMR: Runtime Stability Control for Low-Precision Large Language Model Training

    May 30, 2026Boao Kong, Weichen Jia, Engao Zhang +6Large Language Model TrainingFull-Precision Performance

  20. Stochastic Rounding Increases Small Singular Values

    May 29, 2026Linkai Ma, Tingzhou Yu, Petros DrineasSingular Value DecompositionFull-Precision Performance

  21. Fast and Stable Triangular Inversion for Delta-Rule Linear Transformers

    May 20, 2026Aleksandros Sobczyk, Gioele Gottardo, Christos K. Matzoros +4Kimi Delta AttentionMatrix Multiplication

  22. FTerViT: Fully Ternary Vision Transformer

    May 20, 2026Szymon Ruciński, Pietro Bonazzi, Engin Türetken +3Self-Supervised Vision TransformersVision Transformer

  23. Exploring Bottlenecks in VLM-LLM Navigation: How 3D Scene Understanding Capability Impacts Zero-Shot VLN

    May 14, 2026Ziyi Xia, Chaoran Xiong, Litao Wei +2Vision-Language Navigation3D Scene Understanding

  24. Direction-Preserving Number Representations

    May 8, 2026Bardia Zadeh, George A. ConstantinidesFull-Precision PerformanceVectors

  25. EULER-ADAS: Energy-Efficient & SIMD-Unified Logarithmic-Posit Engine for Precision-Reconfigurable Approximate ADAS Acceleration

    May 7, 2026Mukul Lokhande, Ratko Pilipovic, Omkar Kokane +2Field-Programmable Gate ArraysEnergy-Efficient

  26. Grokking or Glitching? How Low-Precision Drives Slingshot Loss Spikes

    May 7, 2026Liu Hanqing, Jianjun Cao, Yuanze Li +1Full-Precision PerformanceGrokking

  27. Normalized Architectures are Natively 4-Bit

    May 7, 2026Maxim Fishman, Brian Chmiel, Ron Banner +2Large Language Model QuantizationFull-Precision Performance

  28. Hardware-Aware Neural Feature Extraction for Resource-Constrained Devices

    May 5, 2026Francesco Tosini, Simone Pedroni, Christian Veronesi +5Resource-Constrained Edge DevicesFeature Extraction

  29. DASH-KV: Accelerating Long-Context LLM Inference via Asymmetric KV Cache Hashing

    Apr 21, 2026Jinyu Guo, Zhihan Zhang, Jiehui Xie +7Key-Value Cache CompressionDepthweave-Kv

  30. Training Time Prediction for Mixed Precision-based Distributed Training

    Apr 17, 2026Minchul Kang, Changyong Shin, Jinwoo Jeong +5Training TimeFull-Precision Performance

  31. ARCQuant: Boosting NVFP4 Quantization with Augmented Residual Channels for LLMs

    Jan 12, 2026Haoqian Meng, Yilun Luo, Yafei Zhao +3Full-Precision PerformanceEfficient Large Language Model

  32. Precision autotuning for linear solvers via contextual bandit-based RL

    Jan 2, 2026Erin Carson, Xinye ChenSolver IterationsFull-Precision Performance

  33. Numerical stability analysis of large language models

    Mar 13, 2025Stanislav Budzinskiy, Wenyi Fang, Longbin Zeng +1Transformer ArchitecturesFull-Precision Performance

  34. Comparing YOLOv11 and YOLOv8 for instance segmentation of occluded and non-occluded immature green fruits in complex orchard environment

    Oct 24, 2024Ranjan Sapkota, Manoj KarkeeYolo26Full-Precision Performance

  35. Deep Network Approximation: Beyond ReLU to Diverse Activation Functions

    Jul 13, 2023Shijun Zhang, Jianfeng Lu, Hongkai ZhaoActivation FunctionsRectified Linear Unit Networks

  36. FP8 is All You Need (Part 1): Debunking Hardware FP64 as the HPC Holy Grail (Sep 3rd version)

    Date pendingSatoshi MatsuokaHigh-Performance ComputingFp8