AI・機械学習 INT8・INT4量子化で精度はどう変わる?FashionMNIST 1万枚でfake quantization 実験日: 2026-08-24環境: RTX 5070 Ti / WSL2 / PyTorch 2.13.0+cu130量子化はmodelを小さく高速にできる手法として紹介されます。しかし「4 bitならFP32の1/8」という容量計算だけ... 2026.08.24 AI・機械学習