コンテンツへスキップ
Windows・WSL・ネットワーク・FPGAを、実測と手順で解決
ぬるま湯ハードウェア
  • ホーム
  • FPGA
  • 環境構築
  • 技術記事一覧
  • English
    Technical articles written in English.
  • AI・機械学習
    ローカルLLM、機械学習、GPU実験、RAG、推論最適化を再現可能な手順と実測で扱います。
  • ホーム
  • FPGA
  • 環境構築
  • 技術記事一覧
  • English
    Technical articles written in English.
  • AI・機械学習
    ローカルLLM、機械学習、GPU実験、RAG、推論最適化を再現可能な手順と実測で扱います。

Q8_0

AI・機械学習

Q4とQ8はどちらを選ぶ?Gemma 3 4Bを容量・VRAM・速度・96回答で比較

GPU: RTX 5070 Ti 16GB / WSL2 / Ollama 0.32.15Gemma 3 4BのQ4_K_MとQ8_0を、同じPCで動かして比べました。Q8にするとGPU使用量が約1.5 GiB増え、生成速度は180.6から...
2026.08.24
AI・機械学習

最近の投稿

  • Is PyTorch waiting for data? Comparing DataLoader workers with torch.profiler
  • ONNX INT8 quantization made this CNN smaller—but slower on the CPU
  • HOG + SVM versus a small CNN on FashionMNIST: accuracy, runtime and different mistakes
  • ONNXのCNNを実際にINT8量子化したら速くなる?精度・容量・CPU推論を比較
  • PyTorch学習が遅いのはDataLoaderかGPUか?profilerで待ち時間を切り分ける

最近のコメント

  1. Vivadoで不要なバス幅をカット!XLSliceの活用方法 に 匿名 より
  2. Overleafのローカル環境を構築する方法 に ピカチウ より
  3. Vivadoのブロックデザインを共有する方法 に 匿名 より
  4. Alveo U50でVivado Design Flowを使用してDMAサンプルを実行した に ぐんまちゃん より

アーカイブ

  • 2026年9月
  • 2026年8月
  • 2026年7月
  • 2026年5月
  • 2026年4月
  • 2025年6月
  • 2025年5月
  • 2025年2月
  • 2025年1月
  • 2024年12月
  • 2024年11月
  • 2024年3月
  • 2023年12月
  • 2023年11月

カテゴリー

  • AI・機械学習
  • English
  • FPGA
  • Network
  • カス日記
  • 未分類
  • 環境構築
ぬるま湯ハードウェア
  • 広告掲載ポリシー
  • 運営者情報
  • プライバシーポリシー
© 2023-2026 ぬるま湯ハードウェア.
    • ホーム
    • FPGA
    • 環境構築
    • 技術記事一覧
    • English
    • AI・機械学習
  • ホーム
  • トップ