pytorch-quantization

Techniques for model size reduction and inference acceleration using INT8 quantization, including Post-Training Quantization (PTQ) and Quantization Aware Training (QAT). (quantization, int8, qat, fbgemm, qnnpack, ptq, dequantize)

查看源碼 framework-internals

maintainer

cuba6112

更新於 12/26/2025

星標

分支

quick start

Installation and usage

安裝

$ install --globalskills.sh

使用

安裝後，您可以通過在終端運行以下命令來使用此技能：

skills use pytorch-quantization