トップ › 解説記事

Ollamaの始め方【Windows版】インストールから最初のAIとの会話まで

更新日:2026年10月3日

Ollama(オラマ)は、パソコンの中でAIを動かすための無料ソフトです。インストールしてコマンドを1行入力するだけで、ChatGPTのようなAIと会話できます。インターネットに会話内容を送らないので、仕事の資料なども安心して扱えます。

この記事では、WindowsにOllamaを入れて、最初のAIと会話するまでを順番に説明します。

動作に必要なもの

Ollamaの公式ドキュメントによると、Windows版の動作条件は次のとおりです。

項目条件
OSWindows 10 22H2以降(Home・Proどちらも可)
NVIDIAのGPUドライバー 551.61以降
AMDのGPUROCm v7(HIP7)対応ドライバー、またはVulkan対応のRadeonドライバー
ディスク容量本体に約4GB + モデルごとに数GB〜数百GB

GPUがなくても動きますが、速度はかなり遅くなります。公式には、快適に使うには8GB以上のVRAM(GPUのメモリ)が推奨されています。

自分のPCでどのモデルが動くかは、ローカルAI動作チェッカーで事前に確認できます。

手順1:Ollamaをインストールする

  1. Ollamaの公式サイトから、Windows版の OllamaSetup.exe をダウンロードします。
  2. ダウンロードしたファイルをダブルクリックして、画面の指示に従ってインストールします。管理者権限は必要ありません。
  3. インストールが終わると、Ollamaはバックグラウンドで自動的に起動します。

手順2:AIモデルを動かしてみる

スタートメニューで「PowerShell」または「ターミナル」を開き、次のコマンドを入力してEnterを押します。

ollama run gemma4:e2b

初回はモデルのダウンロードが始まります(数GBあるので、数分かかります)。終わると >>> という入力欄が出るので、日本語で質問してみましょう。

>>> 日本の首都はどこですか?

会話を終えるときは /bye と入力します。

コマンドが苦手な方は、Ollamaのアプリ画面からモデルを選んでチャットすることもできます。

どのモデルを選べばいい?

最初は小さめのモデルから試すのがおすすめです。

GPU別のおすすめは、RTX 4060 Ti 16GBで動くAIモデルの記事でも紹介しています。

手順3:GPUで動いているか確認する

モデルを動かしている間に、別のターミナルで次のコマンドを入力します。

ollama ps

「PROCESSOR」の欄が 100% GPU なら、すべてGPUで動いていて快適です。CPU/GPU の割合が出ている場合は、VRAMに収まりきらず一部をメインメモリで動かしているため、速度が落ちます。その場合は、ひとつ小さいモデルを試してみてください。

よく使うコマンド

コマンド内容
ollama run モデル名モデルをダウンロードして会話を始める
ollama listダウンロード済みのモデルを一覧表示
ollama ps今動いているモデルと、GPU・CPUの使用状況を表示
ollama rm モデル名モデルを削除してディスクを空ける

知っておくと便利な設定

モデルの保存場所を変える

モデルは標準で %HOMEPATH%\.ollama(ユーザーフォルダ内)に保存されます。Cドライブの空きが少ない場合は、Windowsの環境変数 OLLAMA_MODELS に別ドライブのフォルダを設定し、Ollamaを再起動すると保存先を変えられます。

一度に扱える文章の長さ(コンテキスト長)

Ollamaは、VRAMの大きさに応じてコンテキスト長の初期値を決めています。公式ドキュメントでは、VRAM 24GB未満なら4K、24〜48GBなら32K、48GB以上なら256Kです。

長い文書を読ませたいときは、Ollamaアプリの設定画面にあるスライダーで長くできます。ただし、長くするほど必要なメモリも増えます。

まとめ

Ollamaなら、インストールとコマンド1行で、無料でローカルAIを始められます。まずは小さなモデルで試して、慣れてきたらチェッカーで自分のPCに合った大きめのモデルに挑戦してみてください。

参考:Ollama公式ドキュメント(Windows)、コンテキスト長、FAQ

自分のPCで動くモデルを調べるなら → ローカルAI動作チェッカー