Ollamaセットアップと実行手順(Windows)
Ollamaは、ローカル環境でLLM(大規模言語モデル)を
簡単に管理・実行できるオープンソースのツールです。
小さいモデルであれば、インターネットに接続せずに、
自分のPC上で利用できるようになります。CPUのみでも動くモデルもあり。
インストール手順
公式サイトから「Download for Windows」をクリック。
ダウンロードされた OllamaSetup.exe を実行するだけでOK。

バージョン確認
コマンドプロンプト
ollama --version
モデルのダウンロード
方法1:標準
ollama pull {モデル}
(例:Qwen3:4b)
ollama pull Qwen3:4b
他のモデルは以下サイトで探します。
方法2:hugginfaceからダウンロード(ggufファイル)
ollama pull hf.co/{ユーザー名}/{リポジトリ名}:{量子化タイプ}
(例:Qwen3-4B-GGUF:Q4_K_M)
ollama pull hf.co/Qwen/Qwen3-4B-GGUF:Q4_K_M
【補足】以下を書くのに確認する場所
ollama pull hf.co/{ユーザー名}/{リポジトリ名}:{量子化タイプ}
hugginfaceのモデルダウンロードサイトを開く
(例:Qwen3-4B-GGUF:Q4_K_M)
https://huggingface.co/Qwen/Qwen3-4B-GGUF
Files and versionsタブをクリック

ollama pull hf.co/{ユーザー名}/{リポジトリ名}:{量子化タイプ}
{ユーザー名}/{リポジトリ名} 上段の赤ライン(Qwen/Qwen3-4B-GGUF)
{量子化タイプ} 下段の赤ライン(Q4_K_M)
ollama pull hf.co/Qwen/Qwen3-4B-GGUF:Q4_K_M

【参考】
モデルがダウンロードされていない状態で、
runすれば、ダウンロード&実行まで実施することもできます。
(例:Qwen3-4B-GGUF:Q4_K_M)
ollama run hf.co/Qwen/Qwen3-4B-GGUF:Q4_K_M
モデルの実行
方法1:テキスト入力で直接実行
ollama run {モデル} {プロンプト}
(例:Qwen3:4b)
ollama run Qwen3:4b "はじめまして!"
(例:Qwen3-4B-GGUF:Q4_K_M)
ollama run hf.co/Qwen/Qwen3-4B-GGUF:Q4_K_M "初めまして!"
thinkモデルで think を省略したい場合: /no_thinkを付ける。
ollama run hf.co/Qwen/Qwen3-4B-GGUF:Q4_K_M "初めまして! /no_think" 
方法2:対話モード(プロンプトを後から打ち込む)
ollama run {モデル}
{プロンプト}
(例:Qwen3-4B-GGUF:Q4_K_M)
ollama run hf.co/Qwen/Qwen3-4B-GGUF:Q4_K_M
初めまして!
thinkモデルでthinkいらないなら、 /no_thinkを付ける。
初めまして! /no_think 
モデル管理
ダウンロード済みモデル一覧表示
ollama list
モデル削除
ollama rm <モデル名>
ollama rm <モデル名>
色々試すと容量がどんどんなくなるので、定期的に整理しましょう。
【参考】モデルデータが入っているフォルダ
C:\Users\ユーザ名.ollama\models

更新
デスクトップ右下のタスクバーの
^(隠れているインジケーターを表示します)をクリックOllamaアイコンをチェック
更新があれば、Ollamaアイコンに緑●がついているので、
OllamaアイコンをクリックRestart to updateをクリック
更新を待つのみ。





