トップ › 解説記事

RTX 3060 12GBで動くAIモデルは?コスパGPUのおすすめローカルLLM【2026年版】

更新日:2026年10月3日

RTX 3060 12GBは、VRAMが12GBあるのに価格が手ごろなため、ローカルAI入門用として中古市場でも人気のGPUです。この記事では、このGPUで動くAIモデルを紹介します。

結論:おすすめはこの3つ

動くモデルの一覧

条件:RTX 3060 12GB、メインメモリ32GB、Q4量子化、コンテキスト8K。数値はローカルAI動作チェッカーによる計算上の目安です。

モデル必要メモリ速度の目安判定
Gemma 4 12B約8.7GB約29トークン/秒快適
Qwen3.5 9B約7.3GB約34トークン/秒快適
Gemma 4 E4B約7.2GB約57トークン/秒快適
Llama 3.1 8B約6.5GB約45トークン/秒快適
gpt-oss 20B約14GB約41トークン/秒一部メインメモリで動く
Qwen3.5 / 3.6 35B-A3B約24GB約26トークン/秒一部メインメモリで動く
Gemma 4 26B-A4B約18GB約25トークン/秒一部メインメモリで動く
Qwen3.5 / 3.6 27B約17GB約6トークン/秒動くが遅め
Gemma 4 31B約21GB約4トークン/秒動くが遅め

RTX 3060 12GBの強みと弱み

強みは、価格に対してVRAMが大きいことです。8GBのGPUでは入りきらないGemma 4 12Bなどが、すべてGPUで動きます。

弱みは、メモリ帯域が360GB/sとやや控えめなことです。ローカルAIの速度はメモリ帯域にほぼ比例するため、同じモデルでもRTX 4070(504GB/s)より遅くなります。

大きなモデルはMoEを選ぶ

12GBを超えるモデルを動かしたいときは、名前に「A3B」「A4B」と付いたMoEモデルを選ぶのがコツです。1回の計算で使う部分が小さいため、メインメモリにはみ出しても速度が落ちにくい特徴があります。

反対に、Qwen3.5 27Bのような通常のモデルは、はみ出すと1秒に数トークン程度まで遅くなります。

まとめ

RTX 3060 12GBなら、Gemma 4 12BやQwen3.5 9Bが快適に動き、MoEモデルを使えば35B級にも届きます。コストを抑えてローカルAIを始めたい方におすすめのGPUです。

ほかのGPUとの比較はVRAM 8GBで動くAIモデル、RTX 4060 Ti 16GBで動くAIモデルもご覧ください。

自分のPCで動くモデルを調べるなら → ローカルAI動作チェッカー