Fit check

我的 Mac 能跑本地大模型吗?逐模型内存速查

在为本地 AI 买 Mac 之前最常见的问题:这个模型到底装不装得进这台机器?本页表格与适配探索器使用同一套容量计算——公开权重大小对比可用统一内存——直接给出每个当前模型的最低 Mac 档位。

最后复核:2026年8月29日 · 独立建议,不是 Apple 建议

简短结论

Mac 能否跑本地模型,先看存储的权重能否放进扣除 macOS、运行工具和上下文保留之后的可用统一内存。规划口径:统一内存约 75% 可用,另留 4GB 给运行工具和上下文,4-bit 量化大约每十亿参数 0.6GB。超过这道算术,你选的是速度和工作流,不是容量。

每个当前模型的最低 Mac 档位

每一行都复用适配引擎的容量计算:可用内存为统一内存的 75% 再减 4GB 运行与上下文保留,剩余不足 4GB 记为紧配。「第一个有余量的档位」与适配探索器的购买决策卡使用同一阈值。点击模型名可直接在交互探索器中打开。

每个当前模型的最低可行 Mac 档位,与适配探索器使用同一套容量计算
模型权重(量化)最低能装下的档位第一个有余量的档位16GB Mac mini M6
Qwen3.8 27B (27B)16.06GB · 已核验文件大小 (Q4_0)Mac mini M6 · 32GB · 紧配 · 3.94GB GB 余量Mac mini M5 Pro · 48GB · 15.94GB GB 余量装不下
Qwen3.8-Flash-Next 180B (6B active) (180B total · 6B active)360GB · 已核验文件大小 (BF16)Mac Studio M5 Ultra · 512GB · 有余量 · 20GB GB 余量Mac Studio M5 Ultra · 512GB · 20GB GB 余量装不下
Qwen3.8 2.4T-A95B (2400B total · 95B active)1440GB · 规划估算 (Q4_K_M)目录内无 Mac 可装下装不下
DeepSeek-V4-Flash 284B-A13B (284B total · 13B active)170.4GB · 规划估算 (MLX-4bit)Mac Studio M5 Ultra · 256GB · 有余量 · 17.6GB GB 余量Mac Studio M5 Ultra · 256GB · 17.6GB GB 余量装不下
DeepSeek-V4-Pro 1.6T-A49B (1600B total · 49B active)960GB · 规划估算 (MLX-4bit)目录内无 Mac 可装下装不下
GLM-5.3-Flash 320B-A18B (320B total · 18B active)203.99GB · 已核验文件大小 (MLX-4bit)Mac Studio M5 Ultra · 512GB · 有余量 · 176.01GB GB 余量Mac Studio M5 Ultra · 512GB · 176.01GB GB 余量装不下
GLM-5.3 744B-A40B (744B total · 40B active)446.4GB · 规划估算 (MLX-4bit)目录内无 Mac 可装下装不下
Gemma 4 E2B (5.1B)3.35GB · 已核验文件大小 (Q4_0)Mac mini M6 · 16GB · 有余量 · 4.65GB GB 余量Mac mini M6 · 16GB · 4.65GB GB 余量有余量
Gemma 4 12B Unified (11.95B)6.98GB · 已核验文件大小 (Q4_0)Mac mini M6 · 16GB · 紧配 · 1.02GB GB 余量Mac mini M6 · 24GB · 7.02GB GB 余量紧配
Gemma 4 26B-A4B (25.2B total · 3.8B active)14.44GB · 已核验文件大小 (Q4_0)Mac mini M6 · 32GB · 有余量 · 5.56GB GB 余量Mac mini M6 · 32GB · 5.56GB GB 余量装不下

容量计算怎么算

  1. 存储权重是容量门槛。模型文件必须先放得进内存,其他都排后面。MoE 模型按完整存储包计算,活跃参数不会降低内存需求。
  2. 可用内存小于标称值。按统一内存的 75% 规划模型,再留 4GB 给 macOS、运行工具和可用上下文;16GB 的 Mac 实际按约 8GB 规划权重。
  3. 紧配与有余量分开。权重装完后剩余不足 4GB 时,长提示、Agent 和并发任务可能越过界线,该档位标为紧配而不是有余量。
边界:装得下不等于跑得好。运行工具支持(MLX、Ollama、llama.cpp)、工具调用、视觉和持续行为在证据页与探索器中单独跟踪。

当答案是否定时

模型装不下时,更快的芯片改变不了答案——门槛是内存。按成本从低到高的现实选项:换同模型的更小量化、换仍然够用的更小或蒸馏模型,或把该工作流留给云端 API、Mac 只跑装得下的模型。不要为某一个 Mac 运行工具证据仍未核验的模型直接买顶配内存的 Mac Studio;先看运行工具证据。

交互工具

查你的具体配置。

选择模型、量化和运行工具,查看权重预算、剩余内存,以及进入免费买/留/等顾问的下一步。

打开适配探索器

查看完整证据矩阵

常见问题

先看清容量边界。

16GB 的 Mac 能跑 70B 模型吗?

不能。70B 模型 4-bit 量化的权重大约 42GB,而 16GB 的 Mac 在扣除系统、运行工具和上下文保留后规划预算约 8GB。这不是速度问题,是权重装不下。即使 32B 模型 Q4(约 20GB 权重)在 32GB Mac 上扣除保留后也只是紧配。

MoE 的活跃参数会更省内存吗?

不会。混合专家模型仍要把全部专家存进内存。活跃参数解释的是每 token 计算量,不是容量;284B-A13B 模型需要的内存远高于 13B 活跃参数给人的直觉。

「装得下且有余量」等于会跑得好吗?

不等于。装得下只回答权重是否放进内存预算。前置处理速度、长上下文、工具调用、并发和持续行为取决于具体模型、运行工具(MLX、Ollama、llama.cpp)和客户端,需要单独核验。

2026 年买哪台 Mac 跑本地大模型?

从模型出发,而不是芯片名。先用上表找最低有余量档位,再把上下文长度、并发和预算带入免费顾问。完整决策指南按工作负载比较 Mac mini M6、M5 Pro 和 Mac Studio。

权重大小经过核验吗?

标注「已核验文件大小」的行使用官方或社区仓库的精确公开文件字节数,核验日期 2026-08-28;标注「规划估算」的行使用每十亿参数 0.6GB 的标注规则,在读回精确文件前保持估算。

带入真实工作流

把容量结论变成买/留/等判断。

免费顾问会加入你的当前 Mac、上下文、并发、预算、兼容性与离线要求;容量只是决策的一部分。

开始免费顾问

Keep or Upgrade 是独立的决策支持工具;Apple 不赞助或背书本页。