AI・機械学習 ONNXのCNNを実際にINT8量子化したら速くなる?精度・容量・CPU推論を比較
English version重みを丸める実験に続いて、今度はONNX RuntimeでINT8のモデルを作り、CPUで実行しました。ファイルは約72%小さくなりましたが、推論は試した3種類のバッチサイズすべてで遅くなりました。正解率は86...
AI・機械学習
AI・機械学習