Fit check

Mon Mac peut-il faire tourner un LLM local ? Vérification mémoire par modèle

Réponse directe à la question la plus courante avant d'acheter un Mac pour l'IA locale : ce modèle tient-il vraiment dans cette machine ? Le tableau utilise la même arithmétique de capacité que notre explorateur : tailles publiques des poids contre mémoire unifiée utilisable.

Dernière vérification : 29 août 2026 · Aide indépendante, pas un conseil Apple

Conclusion rapide

Un Mac ne peut exécuter un modèle local que si les poids stockés tiennent dans la mémoire unifiée utilisable après macOS, le runtime et les réserves de contexte. Règle de planification : environ 75% de la mémoire unifiée est utilisable, gardez 4GB pour le runtime et le contexte, et une quantification 4 bits demande environ 0.6GB par milliard de paramètres. Au-delà de cette arithmétique, vous choisissez vitesse et flux de travail, pas capacité.

Le niveau Mac minimum pour chaque modèle actuel

Chaque ligne réutilise l'arithmétique du moteur : la mémoire utilisable vaut 75% de la mémoire unifiée moins une réserve de 4GB pour runtime et contexte, et un niveau est « juste » s'il reste moins de 4GB. Le premier niveau avec marge réelle suit le même seuil que la carte de décision de l'explorateur. Touchez un modèle pour l'ouvrir dans l'explorateur interactif.

Niveau Mac minimum par modèle actuel, avec la même arithmétique de capacité que l'explorateur
ModèlePoids (quantification)Niveau minimum qui tientPremier niveau avec marge réelle16GB Mac mini M6
Qwen3.8 27B (27B)16.06GB · taille de fichier vérifiée (Q4_0)Mac mini M6 · 32GB · Juste · 3.94GB GB restantsMac mini M5 Pro · 48GB · 15.94GB GB restantsNe tient pas
Qwen3.8-Flash-Next 180B (6B active) (180B total · 6B active)360GB · taille de fichier vérifiée (BF16)Mac Studio M5 Ultra · 512GB · Avec marge · 20GB GB restantsMac Studio M5 Ultra · 512GB · 20GB GB restantsNe tient pas
Qwen3.8 2.4T-A95B (2400B total · 95B active)1440GB · estimation de planification (Q4_K_M)Aucun Mac du catalogue ne convientNe tient pas
DeepSeek-V4-Flash 284B-A13B (284B total · 13B active)170.4GB · estimation de planification (MLX-4bit)Mac Studio M5 Ultra · 256GB · Avec marge · 17.6GB GB restantsMac Studio M5 Ultra · 256GB · 17.6GB GB restantsNe tient pas
DeepSeek-V4-Pro 1.6T-A49B (1600B total · 49B active)960GB · estimation de planification (MLX-4bit)Aucun Mac du catalogue ne convientNe tient pas
GLM-5.3-Flash 320B-A18B (320B total · 18B active)203.99GB · taille de fichier vérifiée (MLX-4bit)Mac Studio M5 Ultra · 512GB · Avec marge · 176.01GB GB restantsMac Studio M5 Ultra · 512GB · 176.01GB GB restantsNe tient pas
GLM-5.3 744B-A40B (744B total · 40B active)446.4GB · estimation de planification (MLX-4bit)Aucun Mac du catalogue ne convientNe tient pas
Gemma 4 E2B (5.1B)3.35GB · taille de fichier vérifiée (Q4_0)Mac mini M6 · 16GB · Avec marge · 4.65GB GB restantsMac mini M6 · 16GB · 4.65GB GB restantsAvec marge
Gemma 4 12B Unified (11.95B)6.98GB · taille de fichier vérifiée (Q4_0)Mac mini M6 · 16GB · Juste · 1.02GB GB restantsMac mini M6 · 24GB · 7.02GB GB restantsJuste
Gemma 4 26B-A4B (25.2B total · 3.8B active)14.44GB · taille de fichier vérifiée (Q4_0)Mac mini M6 · 32GB · Avec marge · 5.56GB GB restantsMac mini M6 · 32GB · 5.56GB GB restantsNe tient pas

Comment fonctionne l'arithmétique

  1. Les poids stockés sont la porte de capacité. Le fichier du modèle doit d'abord tenir. Pour les MoE, c'est le paquet complet qui compte : les paramètres actifs ne réduisent pas le besoin.
  2. La mémoire utilisable est inférieure au chiffre affiché. Budgétez 75% de la mémoire unifiée pour le modèle et gardez 4GB pour macOS, le runtime et un contexte utile ; un Mac 16GB planifie environ 8GB de poids.
  3. Juste contre marge. S'il reste moins de 4GB après les poids, les prompts longs, les agents et les tâches concurrentes peuvent franchir la limite : ce niveau est « juste », pas avec marge.
Limite : tenir n'est pas bien tourner. Le support runtime (MLX, Ollama, llama.cpp), les appels d'outils, la vision et le comportement soutenu se suivent à part sur la page de preuves et dans l'explorateur.

Quand la réponse est non

Si le modèle ne tient pas, une puce plus rapide ne change pas la réponse : la porte, c'est la mémoire. Options réalistes par coût : une quantification plus petite du même modèle, un modèle plus petit ou distillé qui suffit, ou laisser cette charge à une API cloud et réserver le Mac aux modèles qui tiennent. N'achetez pas un Mac Studio à mémoire maximale pour un seul modèle dont le runtime Mac reste non vérifié ; vérifiez d'abord les preuves de runtime.

Outil interactif

Vérifiez votre configuration exacte.

Choisissez modèle, quantification et runtime pour voir le budget de poids, la mémoire restante et la suite vers le conseiller gratuit.

Ouvrir l'explorateur

Voir la matrice complète de preuves

Questions fréquentes

Comprendre d'abord la limite de capacité.

Un Mac 16GB peut-il faire tourner un modèle 70B ?

Non. Un 70B quantifié 4 bits stocke environ 42GB de poids, alors qu'un Mac 16GB planifie environ 8GB après réserves. Ce n'est pas une question de vitesse : les poids ne tiennent pas. Même un 32B en Q4 (environ 20GB) reste « juste » sur un Mac 32GB après réserves.

Les paramètres actifs MoE réduisent-ils la mémoire nécessaire ?

Non. Les modèles mixture-of-experts stockent tous leurs experts. Les paramètres actifs expliquent le calcul par token, pas la capacité. Un 284B-A13B demande bien plus de mémoire que ses 13B actifs ne le suggèrent.

« Tient avec marge » promet-il un bon fonctionnement ?

Non. L'adéquation répond seulement à la question du budget mémoire. Vitesse de préfill, contexte long, appels d'outils, concurrence et comportement soutenu dépendent du modèle, du runtime (MLX, Ollama, llama.cpp) et du client, à vérifier séparément.

Quel Mac acheter pour des LLM locaux en 2026 ?

Partez du modèle, pas du nom de puce. Utilisez le tableau pour le niveau minimum avec marge réelle, puis passez au conseiller gratuit votre contexte, concurrence et budget. Le guide complet compare Mac mini M6, M5 Pro et Mac Studio par charge.

Les tailles de poids sont-elles vérifiées ?

Les lignes « taille vérifiée » utilisent des octets publics exacts de dépôts officiels ou communautaires, contrôlés le 2026-08-28. Les lignes « estimation » suivent la règle 0.6GB par milliard de paramètres et restent des estimations jusqu'à lecture d'un fichier exact.

Apportez votre flux réel

Transformez la capacité en décision d'achat.

Le conseiller gratuit ajoute votre Mac actuel, contexte, concurrence, budget, compatibilité et exigences hors ligne. La capacité n'est qu'une partie de la décision.

Ouvrir le conseiller gratuit

Keep or Upgrade est un outil indépendant ; Apple ne parraine ni n'approuve cette page.