トップ › 解説記事

MacでローカルAIを動かす方法|Apple シリコンのメモリ別おすすめモデル【2026年版】

更新日:2026年10月3日

Apple シリコン(M1〜M5)を搭載したMacは、実はローカルAIにとても向いています。この記事では、MacでAIを動かす方法と、メモリ容量別のおすすめモデルを紹介します。

MacがローカルAIに向いている理由

Apple シリコンのMacは、メインメモリをCPUとGPUで共有する仕組み(ユニファイドメモリ)になっています。WindowsのPCではGPUのVRAMが8〜16GB程度のことが多いのに対し、Macならメモリ48GBや64GBの機種で、その大部分をAIに使えます。

ただし、メモリをすべてGPUに使えるわけではありません。当サイトのチェッカーでは、搭載メモリの約7割をAIに使える目安として計算しています。

必要な環境

Ollamaの公式ドキュメントによると、Mac版の動作条件は次のとおりです。

インストール手順

  1. Ollamaの公式サイトからMac版をダウンロードします。
  2. ダウンロードしたファイルを開き、Ollamaのアイコンを「アプリケーション」フォルダにドラッグします。
  3. Ollamaを起動すると、ターミナルで ollama コマンドを使えるようにする設定を案内してくれます。
  4. 「ターミナル」を開き、ollama run gemma4:e2b と入力すると、モデルのダウンロードと会話が始まります。

モデルは ~/.ollama に保存されます。1つ数GB〜数十GBあるので、ストレージの空きに注意してください。

メモリ別のおすすめモデル

条件:Q4量子化、コンテキスト8K。数値はローカルAI動作チェッカーによる計算上の目安です。

メモリ16GB(M4など)

モデル必要メモリ速度の目安
Qwen3.5 9B約7.3GB約12トークン/秒
Gemma 4 E4B約7.2GB約20トークン/秒
Gemma 4 12B約8.7GB約10トークン/秒

9Bクラスまでが目安です。gpt-oss 20B(約14GB)は、16GBのMacでは入りきりません。

メモリ24GB(M4 Proなど)

モデル必要メモリ速度の目安
gpt-oss 20B約14GB約51トークン/秒
Gemma 4 12B約8.7GB約22トークン/秒
Qwen3.5 9B約7.3GB約27トークン/秒

メモリ48GB(M4 Proなど)

モデル必要メモリ速度の目安
Qwen3.5 / 3.6 35B-A3B約24GB約58トークン/秒
Gemma 4 26B-A4B約18GB約45トークン/秒
Qwen3.5 / 3.6 27B約17GB約11トークン/秒

メモリ64GB(M4 Maxなど)

モデル必要メモリ速度の目安
Qwen3.5 / 3.6 35B-A3B約24GB約104トークン/秒
Qwen3.5 / 3.6 27B約17GB約21トークン/秒
Llama 3.3 70B約43GB約8.5トークン/秒

同じメモリ量でもチップで速さが変わる

ローカルAIの速度は、メモリの「帯域」(データを読み出す速さ)でほぼ決まります。無印のM4は120GB/s、M4 Proは273GB/s、M4 Max(上位版)は546GB/sです。同じモデルでも、Maxは無印の4倍以上速く動く計算になります。

これからMacを買うなら、メモリ容量(どのモデルを動かせるか)とチップの種類(どれくらい速いか)の両方を見て選ぶのがおすすめです。

まとめ

お使いのMacで動くモデルは、チェッカーの「Mac(Apple シリコン)」から確認できます。

参考:Ollama公式ドキュメント(macOS)

自分のPCで動くモデルを調べるなら → ローカルAI動作チェッカー