Fit check

¿Puede mi Mac ejecutar un LLM local? Comprobación de memoria por modelo

Respuesta directa a la pregunta más común antes de comprar un Mac para IA local: ¿este modelo cabe realmente en esta máquina? La tabla usa la misma aritmética de capacidad que nuestro explorador: tamaños públicos de pesos frente a memoria unificada utilizable.

Última revisión: 29 de agosto de 2026 · Orientación independiente, no consejo de Apple

Conclusión breve

Un Mac puede ejecutar un modelo local solo si los pesos almacenados caben en la memoria unificada utilizable tras reservar macOS, el runtime y el contexto. Regla de planificación: aproximadamente el 75% de la memoria unificada es utilizable, reserva 4GB para runtime y contexto, y una cuantización de 4 bits necesita unos 0.6GB por cada mil millones de parámetros. Más allá de esa aritmética eliges velocidad y flujo de trabajo, no capacidad.

El nivel mínimo de Mac para cada modelo actual

Cada fila reutiliza la aritmética de capacidad del motor: la memoria utilizable es el 75% de la memoria unificada menos una reserva de 4GB para runtime y contexto, y un nivel es ajustado si quedan menos de 4GB. El primer nivel con margen real usa el mismo umbral que la tarjeta de decisión del explorador. Toca cualquier modelo para abrirlo en el explorador interactivo.

Nivel mínimo de Mac por modelo actual, con la misma aritmética de capacidad del explorador de fit
ModeloPesos (cuantización)Nivel mínimo que cabePrimer nivel con margen real16GB Mac mini M6
Qwen3.8 27B (27B)16.06GB · tamaño de archivo verificado (Q4_0)Mac mini M6 · 32GB · Justo · 3.94GB GB libresMac mini M5 Pro · 48GB · 15.94GB GB libresNo cabe
Qwen3.8-Flash-Next 180B (6B active) (180B total · 6B active)360GB · tamaño de archivo verificado (BF16)Mac Studio M5 Ultra · 512GB · Con margen · 20GB GB libresMac Studio M5 Ultra · 512GB · 20GB GB libresNo cabe
Qwen3.8 2.4T-A95B (2400B total · 95B active)1440GB · estimación de planificación (Q4_K_M)Ningún Mac del catálogo lo admiteNo cabe
DeepSeek-V4-Flash 284B-A13B (284B total · 13B active)170.4GB · estimación de planificación (MLX-4bit)Mac Studio M5 Ultra · 256GB · Con margen · 17.6GB GB libresMac Studio M5 Ultra · 256GB · 17.6GB GB libresNo cabe
DeepSeek-V4-Pro 1.6T-A49B (1600B total · 49B active)960GB · estimación de planificación (MLX-4bit)Ningún Mac del catálogo lo admiteNo cabe
GLM-5.3-Flash 320B-A18B (320B total · 18B active)203.99GB · tamaño de archivo verificado (MLX-4bit)Mac Studio M5 Ultra · 512GB · Con margen · 176.01GB GB libresMac Studio M5 Ultra · 512GB · 176.01GB GB libresNo cabe
GLM-5.3 744B-A40B (744B total · 40B active)446.4GB · estimación de planificación (MLX-4bit)Ningún Mac del catálogo lo admiteNo cabe
Gemma 4 E2B (5.1B)3.35GB · tamaño de archivo verificado (Q4_0)Mac mini M6 · 16GB · Con margen · 4.65GB GB libresMac mini M6 · 16GB · 4.65GB GB libresCon margen
Gemma 4 12B Unified (11.95B)6.98GB · tamaño de archivo verificado (Q4_0)Mac mini M6 · 16GB · Justo · 1.02GB GB libresMac mini M6 · 24GB · 7.02GB GB libresJusto
Gemma 4 26B-A4B (25.2B total · 3.8B active)14.44GB · tamaño de archivo verificado (Q4_0)Mac mini M6 · 32GB · Con margen · 5.56GB GB libresMac mini M6 · 32GB · 5.56GB GB libresNo cabe

Cómo funciona la aritmética

  1. Los pesos almacenados son la puerta de la capacidad. El archivo del modelo debe caber antes que cualquier otra cosa. En los MoE cuenta el paquete completo: los parámetros activos no reducen el requisito.
  2. La memoria utilizable es menor que la cifra de marketing. Presupuesta el 75% de la memoria unificada para el modelo y reserva 4GB para macOS, el runtime y un contexto de trabajo; un Mac de 16GB planifica con unos 8GB para pesos.
  3. Ajustado frente a margen. Si quedan menos de 4GB tras los pesos, los prompts largos, los agentes y los trabajos concurrentes pueden superar el límite: ese nivel se marca como ajustado, no con margen.
Límite: caber no es ejecutarse bien. El soporte de runtime (MLX, Ollama, llama.cpp), las llamadas a herramientas, la visión y el comportamiento sostenido se rastrean por separado en la página de evidencias y en el explorador.

Cuando la respuesta es no

Si el modelo no cabe, un chip más rápido no cambia la respuesta: la puerta es la memoria. Opciones realistas por coste: una cuantización menor del mismo modelo, un modelo más pequeño o destilado que cumpla, o dejar esa carga en una API en la nube y reservar el Mac para modelos que quepan. No compres un Mac Studio de memoria máxima por un único modelo cuyo runtime en Mac siga sin verificar; revisa antes la evidencia de runtime.

Herramienta interactiva

Comprueba tu configuración exacta.

Elige modelo, cuantización y runtime para ver el presupuesto de pesos, la memoria restante y el siguiente paso hacia el advisor gratuito de comprar / mantener / esperar.

Abrir el explorador de fit

Ver la matriz completa de evidencias

Preguntas frecuentes

Primero entiende el límite de capacidad.

¿Puede un Mac de 16GB ejecutar un modelo de 70B?

No. Un modelo de 70B con cuantización de 4 bits almacena unos 42GB de pesos, mientras que un Mac de 16GB tiene un presupuesto de planificación de unos 8GB tras las reservas. No es un problema de velocidad: los pesos no caben. Incluso un 32B en Q4 (unos 20GB) queda justo en un Mac de 32GB tras las reservas.

¿Los parámetros activos de un MoE reducen la memoria que necesito?

No. Los modelos mixture-of-experts almacenan todos los expertos. Los parámetros activos explican el cómputo por token, no la capacidad. Un 284B-A13B necesita mucha más memoria de lo que sugieren sus 13B activos.

¿Que 'cabe con margen' promete que funcionará bien?

No. La adaptación solo responde si los pesos caben en el presupuesto. El prefill, el contexto largo, las llamadas a herramientas, la concurrencia y el comportamiento sostenido dependen del modelo, el runtime (MLX, Ollama, llama.cpp) y el cliente, y se comprueban aparte.

¿Qué Mac comprar para LLM locales en 2026?

Empieza por el modelo, no por el nombre del chip. Usa la tabla para el nivel mínimo con margen real y pasa al advisor gratuito tu contexto, concurrencia y presupuesto. La guía completa compara Mac mini M6, M5 Pro y Mac Studio por carga de trabajo.

¿Los tamaños de los pesos están verificados?

Las filas marcadas como tamaño verificado usan bytes públicos exactos de repositorios oficiales o comunitarios, comprobados el 2026-08-28. Las marcadas como estimación usan la regla de 0.6GB por mil millones de parámetros y siguen siendo estimaciones hasta leer un archivo exacto.

Trae tu flujo real

Convierte la capacidad en una decisión de compra.

El advisor gratuito añade tu Mac actual, contexto, concurrencia, presupuesto, compatibilidad y requisitos offline. La capacidad es solo una parte de la decisión.

Abrir el advisor gratuito

Keep or Upgrade es una herramienta independiente; Apple no patrocina ni respalda esta página.