Ollamaの使い方2026〜入れてから、モデルを選んで、使いこなすまで〜
Ollamaの最新版0.34.4を、MacとWindowsで入れるところから使いこなすまで通し直しました。「ローカルで使う」を選んでもチャットの既定はクラウドのモデル、考える機能が最初からオンで1文の答えに71.6秒(切ると1.24秒)。読める長さの既定はGPUのメモリで決まり、Macは32k・RTX 3060は4k。上限を超えると半分まで黙って切り詰め、Windowsは200行で先頭を忘れました。速さはRTX 3060がMacの2.6〜3.0倍、GPUに載らない27BだけMacが逆転。モデルの選び方と最初に見直す6つの設定、スクリプト全文つき。