AI・機械学習 Ollamaのcontext 4K・8K・16Kで何が変わる?長文検索・待ち時間・VRAMを実測 実験日: 2026-08-24GPU: RTX 5070 Ti 16GB / WSL2 / Ollama 0.32.15Model: Gemma 3 4B Q4_K_MOllamaのnum_ctxを大きくすると、長い論文やcodeを一度に読... 2026.08.24 AI・機械学習