Fit check

MacでローカルLLMは動く?モデル別メモリ適合チェック

ローカルAI用のMac購入前に最も多い質問への直接回答:そのモデルはそのMacに実際に収まるのか。表は適合エクスプローラーと同じ容量計算(公開重みサイズ対使用可能なユニファイドメモリ)で、現在の各モデルの最低Mac構成を示します。

最終確認:2026年8月29日 · 独立した判断支援でありAppleの助言ではありません

要点

Macでローカルモデルが動くかは、保存された重みがmacOS・ランタイム・コンテキストの予約を除いた使用可能ユニファイドメモリに収まるかで決まります。計画の目安:ユニファイドメモリの約75%を使用可能とし、4GBをランタイムとコンテキストに確保、4bit量子化は10億パラメータあたり約0.6GB。この算術を超える部分は速度とワークフローの問題で、容量ではありません。

現在の各モデルの最低Mac構成

各行は適合エンジンと同じ容量計算を使用します:使用可能メモリはユニファイドメモリの75%から4GBのランタイム・コンテキスト予約を引いた値で、残り4GB未満は「ぎりぎり」扱いです。「余裕のある最初の構成」は適合エクスプローラーの購入判断カードと同じ閾値です。モデル名をタップすると対話エクスプローラーで開けます。

現在の各モデルの最低Mac構成。適合エクスプローラーと同じ容量計算を使用
モデル重み(量子化)収まる最低構成余裕のある最初の構成16GB Mac mini M6
Qwen3.8 27B (27B)16.06GB · 検証済みファイルサイズ (Q4_0)Mac mini M6 · 32GB · ぎりぎり · 3.94GB GB余裕Mac mini M5 Pro · 48GB · 15.94GB GB余裕収まらない
Qwen3.8-Flash-Next 180B (6B active) (180B total · 6B active)360GB · 検証済みファイルサイズ (BF16)Mac Studio M5 Ultra · 512GB · 余裕あり · 20GB GB余裕Mac Studio M5 Ultra · 512GB · 20GB GB余裕収まらない
Qwen3.8 2.4T-A95B (2400B total · 95B active)1440GB · 計画推定 (Q4_K_M)カタログ内のMacでは収まりません収まらない
DeepSeek-V4-Flash 284B-A13B (284B total · 13B active)170.4GB · 計画推定 (MLX-4bit)Mac Studio M5 Ultra · 256GB · 余裕あり · 17.6GB GB余裕Mac Studio M5 Ultra · 256GB · 17.6GB GB余裕収まらない
DeepSeek-V4-Pro 1.6T-A49B (1600B total · 49B active)960GB · 計画推定 (MLX-4bit)カタログ内のMacでは収まりません収まらない
GLM-5.3-Flash 320B-A18B (320B total · 18B active)203.99GB · 検証済みファイルサイズ (MLX-4bit)Mac Studio M5 Ultra · 512GB · 余裕あり · 176.01GB GB余裕Mac Studio M5 Ultra · 512GB · 176.01GB GB余裕収まらない
GLM-5.3 744B-A40B (744B total · 40B active)446.4GB · 計画推定 (MLX-4bit)カタログ内のMacでは収まりません収まらない
Gemma 4 E2B (5.1B)3.35GB · 検証済みファイルサイズ (Q4_0)Mac mini M6 · 16GB · 余裕あり · 4.65GB GB余裕Mac mini M6 · 16GB · 4.65GB GB余裕余裕あり
Gemma 4 12B Unified (11.95B)6.98GB · 検証済みファイルサイズ (Q4_0)Mac mini M6 · 16GB · ぎりぎり · 1.02GB GB余裕Mac mini M6 · 24GB · 7.02GB GB余裕ぎりぎり
Gemma 4 26B-A4B (25.2B total · 3.8B active)14.44GB · 検証済みファイルサイズ (Q4_0)Mac mini M6 · 32GB · 余裕あり · 5.56GB GB余裕Mac mini M6 · 32GB · 5.56GB GB余裕収まらない

適合計算のしくみ

  1. 保存された重みが容量の関門です。モデルファイルがまずメモリに収まらなければ、それ以外は意味がありません。MoEモデルは保存パッケージ全体で数え、有効パラメータは要件を減らしません。
  2. 使用可能メモリは表示値より少なくなります。ユニファイドメモリの75%をモデルに充て、4GBをmacOS・ランタイム・実用コンテキストに確保します。16GBのMacでは重みは約8GBで計画します。
  3. 「ぎりぎり」と「余裕」を分けます。重みの後に残りが4GB未満なら、長いプロンプト、エージェント、並行タスクで境界を超える可能性があり、その構成は余裕ではなくぎりぎりと表示します。
境界:収まることは動くことではありません。ランタイム対応(MLX、Ollama、llama.cpp)、ツール呼び出し、視覚、持続動作は証拠ページとエクスプローラーで別途追跡します。

答えが「動かない」のとき

モデルが収まらない場合、速いチップは答えを変えません。関門はメモリです。費用の低い順に:同じモデルのより小さい量子化を選ぶ、用途を満たすより小さい・蒸留モデルへ下げる、その作業はクラウドAPIに残しMacには収まるモデルだけ置く。Mac向けランタイム証拠がまだ未検証のモデル一台のために最大メモリのMac Studioを買わないでください。先にランタイム証拠を確認してください。

対話ツール

自分の構成を確認。

モデル・量子化・ランタイムを選ぶと、重み予算、残りメモリ、無料の買う/維持/待つAdvisorへの次の一手が表示されます。

適合エクスプローラーを開く

完全な証拠マトリクスを見る

よくある質問

容量の境界を先に確認。

16GBのMacで70Bモデルは動きますか?

動きません。70Bモデルの4bit量子化は約42GBの重みを保存しますが、16GBのMacはシステム・ランタイム・コンテキスト予約後の計画予算が約8GBです。速度の問題ではなく、重みが収まりません。32BモデルのQ4(約20GB)でも32GBのMacでは予約後にぎりぎりです。

MoEの有効パラメータならメモリは減りますか?

いいえ。専門家混合モデルも全エキスパートをメモリに保存します。有効パラメータはトークンごとの計算量の説明で、容量ではありません。284B-A13Bモデルは13Bの有効値よりはるかに多くのメモリを必要とします。

「余裕を持って収まる」は快適に動く保証ですか?

いいえ。適合は重みがメモリ予算に収まるかだけを答えます。プロンプト処理速度、長文脈、ツール呼び出し、並行、持続動作は正確なモデル、ランタイム(MLX、Ollama、llama.cpp)、クライアント次第で、別途確認が必要です。

2026年のローカルLLM用Macはどれ?

チップ名ではなくモデルから始めてください。上の表で余裕のある最低構成を見つけ、コンテキスト長・並行数・予算を無料Advisorに入れてください。完全な比較ガイドがMac mini M6、M5 Pro、Mac Studioを作業別に比較します。

重みサイズは検証済みですか?

「検証済みファイルサイズ」の行は公式またはコミュニティリポジトリの正確な公開バイト数を使い、2026-08-28に確認しました。「計画推定」の行は10億パラメータあたり0.6GBの規則を使い、正確なファイルを読み取るまで推定のままです。

実際のワークフローを持ち込む

容量の結論を購入判断へ。

無料Advisorは現在のMac、コンテキスト、並行、予算、互換性、オフライン要件を追加します。容量は判断の一部でしかありません。

無料Advisorを始める

Keep or Upgradeは独立した意思決定支援ツールであり、Appleの推奨を受けていません。