Ternary Quantization

Latest papers 19

All topics
CardsList
  1. SSR: Sparse Segment Reduction for Ternary GEMM Acceleration

    Oct 6, 2026Adeline Pittet, Shien Zhu, Valérie Verdan +1Ternary QuantizationLLM Inference Acceleration

  2. Fiona: Accelerating FHE Inference with Packing-Aware Ternary Weights

    Sep 28, 2026Yiteng Peng, Zhibo Liu, Dongwei Xiao +1Mixed-Precision QuantizationEfficient Neural Network Inference

  3. Breaking the 1.58-bit Barrier for Ternary LLMs

    Sep 14, 2026Evangelos Georganas, Alexander Heinecke, Pradeep DubeyTernary QuantizationLLM Compression

  4. ELiTeFormer: An Efficient Transformer for FPGAs

    Jul 4, 2026Victor Agostinelli, Nicolas Bohm Agostini, Antonino TumeoLLM QuantizationTernary Quantization

  5. CAT-Q: Cost-efficient and Accurate Ternary Quantization for LLMs

    Jun 25, 2026Shigeng Wang, Chao Li, Yangyuxuan Kang +2LLM QuantizationTernary Quantization

  6. Ternary Mamba: Grouped Quantization-Aware Training of W1.58A16 State Space Models

    Jun 16, 2026Ramprasath Ganesaraja, Sahil Dilip Panse, Swathika NLLM QuantizationTernary Quantization

  7. TWLA: Achieving Ternary Weights and Low-Bit Activations for LLMs via Post-Training Quantization

    Jun 11, 2026Zhixiong Zhao, Zukang Xu, Zhixuan Chen +3Mixed-Precision QuantizationLLM Quantization

  8. FTerViT: Fully Ternary Vision Transformer

    May 20, 2026Szymon Ruciński, Pietro Bonazzi, Engin Türetken +3Ternary QuantizationVision Transformer