Fit check
¿Puede mi Mac ejecutar un LLM local? Comprobación de memoria por modelo
Respuesta directa a la pregunta más común antes de comprar un Mac para IA local: ¿este modelo cabe realmente en esta máquina? La tabla usa la misma aritmética de capacidad que nuestro explorador: tamaños públicos de pesos frente a memoria unificada utilizable.
Conclusión breve
Un Mac puede ejecutar un modelo local solo si los pesos almacenados caben en la memoria unificada utilizable tras reservar macOS, el runtime y el contexto. Regla de planificación: aproximadamente el 75% de la memoria unificada es utilizable, reserva 4GB para runtime y contexto, y una cuantización de 4 bits necesita unos 0.6GB por cada mil millones de parámetros. Más allá de esa aritmética eliges velocidad y flujo de trabajo, no capacidad.
El nivel mínimo de Mac para cada modelo actual
Cada fila reutiliza la aritmética de capacidad del motor: la memoria utilizable es el 75% de la memoria unificada menos una reserva de 4GB para runtime y contexto, y un nivel es ajustado si quedan menos de 4GB. El primer nivel con margen real usa el mismo umbral que la tarjeta de decisión del explorador. Toca cualquier modelo para abrirlo en el explorador interactivo.
| Modelo | Pesos (cuantización) | Nivel mínimo que cabe | Primer nivel con margen real | 16GB Mac mini M6 |
|---|---|---|---|---|
| Qwen3.8 27B (27B) | 16.06GB · tamaño de archivo verificado (Q4_0) | Mac mini M6 · 32GB · Justo · 3.94GB GB libres | Mac mini M5 Pro · 48GB · 15.94GB GB libres | No cabe |
| Qwen3.8-Flash-Next 180B (6B active) (180B total · 6B active) | 360GB · tamaño de archivo verificado (BF16) | Mac Studio M5 Ultra · 512GB · Con margen · 20GB GB libres | Mac Studio M5 Ultra · 512GB · 20GB GB libres | No cabe |
| Qwen3.8 2.4T-A95B (2400B total · 95B active) | 1440GB · estimación de planificación (Q4_K_M) | Ningún Mac del catálogo lo admite | — | No cabe |
| DeepSeek-V4-Flash 284B-A13B (284B total · 13B active) | 170.4GB · estimación de planificación (MLX-4bit) | Mac Studio M5 Ultra · 256GB · Con margen · 17.6GB GB libres | Mac Studio M5 Ultra · 256GB · 17.6GB GB libres | No cabe |
| DeepSeek-V4-Pro 1.6T-A49B (1600B total · 49B active) | 960GB · estimación de planificación (MLX-4bit) | Ningún Mac del catálogo lo admite | — | No cabe |
| GLM-5.3-Flash 320B-A18B (320B total · 18B active) | 203.99GB · tamaño de archivo verificado (MLX-4bit) | Mac Studio M5 Ultra · 512GB · Con margen · 176.01GB GB libres | Mac Studio M5 Ultra · 512GB · 176.01GB GB libres | No cabe |
| GLM-5.3 744B-A40B (744B total · 40B active) | 446.4GB · estimación de planificación (MLX-4bit) | Ningún Mac del catálogo lo admite | — | No cabe |
| Gemma 4 E2B (5.1B) | 3.35GB · tamaño de archivo verificado (Q4_0) | Mac mini M6 · 16GB · Con margen · 4.65GB GB libres | Mac mini M6 · 16GB · 4.65GB GB libres | Con margen |
| Gemma 4 12B Unified (11.95B) | 6.98GB · tamaño de archivo verificado (Q4_0) | Mac mini M6 · 16GB · Justo · 1.02GB GB libres | Mac mini M6 · 24GB · 7.02GB GB libres | Justo |
| Gemma 4 26B-A4B (25.2B total · 3.8B active) | 14.44GB · tamaño de archivo verificado (Q4_0) | Mac mini M6 · 32GB · Con margen · 5.56GB GB libres | Mac mini M6 · 32GB · 5.56GB GB libres | No cabe |
Cómo funciona la aritmética
- Los pesos almacenados son la puerta de la capacidad. El archivo del modelo debe caber antes que cualquier otra cosa. En los MoE cuenta el paquete completo: los parámetros activos no reducen el requisito.
- La memoria utilizable es menor que la cifra de marketing. Presupuesta el 75% de la memoria unificada para el modelo y reserva 4GB para macOS, el runtime y un contexto de trabajo; un Mac de 16GB planifica con unos 8GB para pesos.
- Ajustado frente a margen. Si quedan menos de 4GB tras los pesos, los prompts largos, los agentes y los trabajos concurrentes pueden superar el límite: ese nivel se marca como ajustado, no con margen.
Cuando la respuesta es no
Si el modelo no cabe, un chip más rápido no cambia la respuesta: la puerta es la memoria. Opciones realistas por coste: una cuantización menor del mismo modelo, un modelo más pequeño o destilado que cumpla, o dejar esa carga en una API en la nube y reservar el Mac para modelos que quepan. No compres un Mac Studio de memoria máxima por un único modelo cuyo runtime en Mac siga sin verificar; revisa antes la evidencia de runtime.
Herramienta interactiva
Comprueba tu configuración exacta.
Elige modelo, cuantización y runtime para ver el presupuesto de pesos, la memoria restante y el siguiente paso hacia el advisor gratuito de comprar / mantener / esperar.
Preguntas frecuentes
Primero entiende el límite de capacidad.
¿Puede un Mac de 16GB ejecutar un modelo de 70B?
No. Un modelo de 70B con cuantización de 4 bits almacena unos 42GB de pesos, mientras que un Mac de 16GB tiene un presupuesto de planificación de unos 8GB tras las reservas. No es un problema de velocidad: los pesos no caben. Incluso un 32B en Q4 (unos 20GB) queda justo en un Mac de 32GB tras las reservas.
¿Los parámetros activos de un MoE reducen la memoria que necesito?
No. Los modelos mixture-of-experts almacenan todos los expertos. Los parámetros activos explican el cómputo por token, no la capacidad. Un 284B-A13B necesita mucha más memoria de lo que sugieren sus 13B activos.
¿Que 'cabe con margen' promete que funcionará bien?
No. La adaptación solo responde si los pesos caben en el presupuesto. El prefill, el contexto largo, las llamadas a herramientas, la concurrencia y el comportamiento sostenido dependen del modelo, el runtime (MLX, Ollama, llama.cpp) y el cliente, y se comprueban aparte.
¿Qué Mac comprar para LLM locales en 2026?
Empieza por el modelo, no por el nombre del chip. Usa la tabla para el nivel mínimo con margen real y pasa al advisor gratuito tu contexto, concurrencia y presupuesto. La guía completa compara Mac mini M6, M5 Pro y Mac Studio por carga de trabajo.
¿Los tamaños de los pesos están verificados?
Las filas marcadas como tamaño verificado usan bytes públicos exactos de repositorios oficiales o comunitarios, comprobados el 2026-08-28. Las marcadas como estimación usan la regla de 0.6GB por mil millones de parámetros y siguen siendo estimaciones hasta leer un archivo exacto.
Trae tu flujo real
Convierte la capacidad en una decisión de compra.
El advisor gratuito añade tu Mac actual, contexto, concurrencia, presupuesto, compatibilidad y requisitos offline. La capacidad es solo una parte de la decisión.
Keep or Upgrade es una herramienta independiente; Apple no patrocina ni respalda esta página.