Synthèse des preuves publiques
Adaptation du modèle local pour Mac mini et Mac Studio
Un outil de planification pour les derniers représentants de poids ouverts Qwen3.8, DeepSeek V4, GLM-5.3 et Gemma 4. Commencez par des données publiques et des calculs de capacité, séparez la durée d'exécution et les preuves de travail, puis décidez si un remplacement est justifié.
Conclusion rapide
Cette page compare les représentants de chaque famille qui vous intéressent actuellement. Les versions précédentes sont conservées uniquement à titre d'enregistrement de compatibilité et exclues de la matrice principale. Même si le modèle tient dans la mémoire, l'appel d'outil, le JSON, le visuel, la concurrence et le comportement persistant peuvent être inconnus.
outils de dialogue
Vérifiez si le modèle est compatible avec votre Mac.
Choisissez votre modèle ou votre configuration Mac pour connaître les budgets pondérés, la marge de mémoire, les preuves d'exécution et les prochaines étapes vers notre conseiller gratuit.
Cet outil de planification combine des cartes de modèles officielles, des métadonnées de fichiers publics GGUF/QAT, de la documentation d'exécution, des évaluations publiées et des rapports communautaires clairement étiquetés. Il ne prétend pas que Keep ou Upgrade a exécuté tous les modèles, et Apple ou les fournisseurs de modèles n'approuvent pas cette page.
Télécharger CSVTélécharger le JSON · Mêmes données sources que cette page
Les téléchargements sont des instantanés faciles à citer avec les URL sources, les niveaux de preuve et la date des données. Lien vers ce Hub comme explication canonique ; les points de terminaison de téléchargement restent en dehors du plan du site.
Mac mini M6 · 16GB153GB/s · US$899 starting price
Matrice de preuves modèles
Modèles à poids ouvert les plus récents et les plus intéressants
La matrice principale donne la priorité aux versions phares actuelles et aux représentants utiles de la planification Mac. La capacité utilise la taille de l'artefact public sélectionné lorsqu'elle est disponible ; les nombres basés sur des paramètres ne sont que des estimations de planification. Développez Sources et limites sur n’importe quelle ligne pour inspecter les signaux de communauté attribuables et leurs limites.
| Famille/niveau | Modèle et version | Quantification / artefact | Capacité sur Mac sélectionné | Preuve d'exécution | Confidence | Details |
|---|---|---|---|---|---|---|
| QwenPetit | Qwen3.8 27BQwen3.8 · 27B dense | Q4_0 · GGUF16.1 GB · Public file metadata | Ne tient pas-8.06GB restants après réserve | Prise en charge officiellemlx2 signaux sociaux · voir les sources | highVérifié 2026-08-28 | Sources et limites
|
| QwenCourant | Qwen3.8-Flash-Next 180B (6B active)Qwen3.8-Flash-Next · 180B total / 6B active | BF16 · Safetensors360.0 GB · Public file metadata | Ne tient pas-352GB restants après réserve | Rapport communautairemlx1 signal social · voir les sources | mediumVérifié 2026-08-28 | Sources et limites
|
| QwenLimite | Qwen3.8 2.4T-A95BQwen3.8 · 2400B total / 95B active | Q4_K_M · GGUF1440.0 GB · Public model source; exact file not registered | Ne tient pas-1432GB restants après réserve | Prise en charge officiellemlx | mediumVérifié 2026-08-28 | Sources et limites
|
| DeepSeekCourant | DeepSeek-V4-Flash 284B-A13BDeepSeek V4 · 284B total / 13B active | MLX-4bit · MLX170.4 GB · Public model source; exact file not registered | Ne tient pas-162.4GB restants après réserve | Rapport communautairemlx7 signaux sociaux · voir les sources | highVérifié 2026-08-28 | Sources et limites
|
| DeepSeekLimite | DeepSeek-V4-Pro 1.6T-A49BDeepSeek V4 · 1600B total / 49B active | MLX-4bit · MLX960.0 GB · Public model source; exact file not registered | Ne tient pas-952GB restants après réserve | Inconnullama.cpp | highVérifié 2026-08-28 | Sources et limites
|
| GLMCourant | GLM-5.3-Flash 320B-A18BGLM-5.3-Flash · 320B total / 18B active | MLX-4bit · MLX204.0 GB · Public file metadata | Ne tient pas-195.99GB restants après réserve | Rapport communautairemlx2 signaux sociaux · voir les sources | highVérifié 2026-08-28 | Sources et limites
|
| GLMLimite | GLM-5.3 744B-A40BGLM-5.3 · 744B total / 40B active | MLX-4bit · MLX446.4 GB · Public model source; exact file not registered | Ne tient pas-438.4GB restants après réserve | Inconnullama.cpp | highVérifié 2026-08-28 | Sources et limites
|
| Google GemmaPetit | Gemma 4 E2BGemma 4 · 2.3B effective / 5.1B total · PLE | Q4_0 · QAT3.35 GB · Public file metadata | Avec marge4.65GB restants après réserve | Rapport communautairellama.cpp1 signal social · voir les sources | highVérifié 2026-08-28 | Sources et limites
|
| Google GemmaCourant | Gemma 4 12B UnifiedGemma 4 · 11.95B dense | Q4_0 · QAT6.98 GB · Public file metadata | Limite1.02GB restants après réserve | Inconnullama.cpp | highVérifié 2026-08-28 | Sources et limites
|
| Google GemmaLimite | Gemma 4 26B-A4BGemma 4 · 25.2B total / 3.8B active | Q4_0 · QAT14.4 GB · Public file metadata | Ne tient pas-6.44GB restants après réserve | Rapport communautairellama.cpp | highVérifié 2026-08-28 | Sources et limites
|
Preuve de capacité
La capacité du flux de travail est une question distincte
Les fenêtres contextuelles sont des métadonnées de modèle. La concurrence, l'appel d'outils, la fiabilité JSON, la vision et le comportement soutenu dépendent du modèle exact, de l'exécution, du client, de la pression de la mémoire et de la tâche. Une cellule positive n’est toujours pas une garantie pour votre flux de travail.
| Modèle | Contexte | Concurrence | Appels d'outils | JSON | Vision | Usage soutenu |
|---|---|---|---|---|---|---|
| Qwen3.8 27BPetit | Prise en charge officiellePublic model metadata lists 262,144 tokens. This is not proof that the selected Mac can hold that context with the weights.Source | Inférence systèmeConcurrency is inferred only from memory budget and runtime architecture. No apples-to-apples public concurrency benchmark is attached.Source | Prise en charge officielleThe current Qwen material documents tool or agent paths. The exact model template and runtime still need a workflow check.Source | InconnuStructured JSON behavior depends on the exact model template, runtime parser, and client; no exact public result is registered here. | InconnuVision support is not assumed from family branding or an unrelated model variant. | InconnuNo public, comparable sustained Apple Silicon run is registered for this model and Mac configuration. |
| Qwen3.8-Flash-Next 180B (6B active)Courant | Prise en charge officiellePublic model metadata lists 262,144 tokens. This is not proof that the selected Mac can hold that context with the weights.Source | Inférence systèmeConcurrency is inferred only from memory budget and runtime architecture. No apples-to-apples public concurrency benchmark is attached.Source | Prise en charge officielleThe current Qwen material documents tool or agent paths. The exact model template and runtime still need a workflow check.Source | InconnuStructured JSON behavior depends on the exact model template, runtime parser, and client; no exact public result is registered here. | Prise en charge officielleThe current model documentation describes multimodal inputs for this representative; the selected Mac runtime path still needs checking.Source | InconnuNo public, comparable sustained Apple Silicon run is registered for this model and Mac configuration. |
| Qwen3.8 2.4T-A95BLimite | Prise en charge officiellePublic model metadata lists 262,144 tokens. This is not proof that the selected Mac can hold that context with the weights.Source | Inférence systèmeConcurrency is inferred only from memory budget and runtime architecture. No apples-to-apples public concurrency benchmark is attached.Source | Prise en charge officielleThe current Qwen material documents tool or agent paths. The exact model template and runtime still need a workflow check.Source | InconnuStructured JSON behavior depends on the exact model template, runtime parser, and client; no exact public result is registered here. | InconnuVision support is not assumed from family branding or an unrelated model variant. | InconnuNo public, comparable sustained Apple Silicon run is registered for this model and Mac configuration. |
| DeepSeek-V4-Flash 284B-A13BCourant | Prise en charge officiellePublic model metadata lists 1,048,576 tokens. This is not proof that the selected Mac can hold that context with the weights.Source | Inférence systèmeConcurrency is inferred only from memory budget and runtime architecture. No apples-to-apples public concurrency benchmark is attached.Source | Prise en charge officielleThe official DeepSeek V4 material documents tool use in the model family. The exact local template and runtime still need a workflow check.Source | InconnuStructured JSON behavior depends on the exact model template, runtime parser, and client; no exact public result is registered here. | InconnuVision support is not assumed from family branding or an unrelated model variant. | InconnuNo public, comparable sustained Apple Silicon run is registered for this model and Mac configuration. |
| DeepSeek-V4-Pro 1.6T-A49BLimite | Prise en charge officiellePublic model metadata lists 1,048,576 tokens. This is not proof that the selected Mac can hold that context with the weights.Source | Inférence systèmeConcurrency is inferred only from memory budget and runtime architecture. No apples-to-apples public concurrency benchmark is attached.Source | Prise en charge officielleThe official DeepSeek V4 material documents tool use in the model family. The exact local template and runtime still need a workflow check.Source | InconnuStructured JSON behavior depends on the exact model template, runtime parser, and client; no exact public result is registered here. | InconnuVision support is not assumed from family branding or an unrelated model variant. | InconnuNo public, comparable sustained Apple Silicon run is registered for this model and Mac configuration. |
| GLM-5.3-Flash 320B-A18BCourant | Prise en charge officiellePublic model metadata lists 1,000,000 tokens. This is not proof that the selected Mac can hold that context with the weights.Source | Inférence systèmeConcurrency is inferred only from memory budget and runtime architecture. No apples-to-apples public concurrency benchmark is attached.Source | Prise en charge officielleThe official GLM-5.3 material documents function calling and agent capabilities. It is not a Mac runtime integration benchmark.Source | Benchmark publicPublic GLM evaluations cover agentic or structured tasks, but they do not establish JSON validity in every client.Source | Prise en charge officielleThe current model documentation describes multimodal inputs for this representative; the selected Mac runtime path still needs checking.Source | InconnuNo public, comparable sustained Apple Silicon run is registered for this model and Mac configuration. |
| GLM-5.3 744B-A40BLimite | Prise en charge officiellePublic model metadata lists 1,000,000 tokens. This is not proof that the selected Mac can hold that context with the weights.Source | Inférence systèmeConcurrency is inferred only from memory budget and runtime architecture. No apples-to-apples public concurrency benchmark is attached.Source | Prise en charge officielleThe official GLM-5.3 material documents function calling and agent capabilities. It is not a Mac runtime integration benchmark.Source | InconnuStructured JSON behavior depends on the exact model template, runtime parser, and client; no exact public result is registered here. | InconnuVision support is not assumed from family branding or an unrelated model variant. | InconnuNo public, comparable sustained Apple Silicon run is registered for this model and Mac configuration. |
| Gemma 4 E2BPetit | Prise en charge officiellePublic model metadata lists 131,072 tokens. This is not proof that the selected Mac can hold that context with the weights.Source | Inférence systèmeConcurrency is inferred only from memory budget and runtime architecture. No apples-to-apples public concurrency benchmark is attached.Source | InconnuNo model-specific public tool-calling result is strong enough for a positive claim in this snapshot. | InconnuStructured JSON behavior depends on the exact model template, runtime parser, and client; no exact public result is registered here. | Prise en charge officielleThe current model documentation describes multimodal inputs for this representative; the selected Mac runtime path still needs checking.Source | InconnuNo public, comparable sustained Apple Silicon run is registered for this model and Mac configuration. |
| Gemma 4 12B UnifiedCourant | Prise en charge officiellePublic model metadata lists 262,144 tokens. This is not proof that the selected Mac can hold that context with the weights.Source | Inférence systèmeConcurrency is inferred only from memory budget and runtime architecture. No apples-to-apples public concurrency benchmark is attached.Source | InconnuNo model-specific public tool-calling result is strong enough for a positive claim in this snapshot. | InconnuStructured JSON behavior depends on the exact model template, runtime parser, and client; no exact public result is registered here. | InconnuVision support is not assumed from family branding or an unrelated model variant. | InconnuNo public, comparable sustained Apple Silicon run is registered for this model and Mac configuration. |
| Gemma 4 26B-A4BLimite | Prise en charge officiellePublic model metadata lists 262,144 tokens. This is not proof that the selected Mac can hold that context with the weights.Source | Inférence systèmeConcurrency is inferred only from memory budget and runtime architecture. No apples-to-apples public concurrency benchmark is attached.Source | InconnuNo model-specific public tool-calling result is strong enough for a positive claim in this snapshot. | InconnuStructured JSON behavior depends on the exact model template, runtime parser, and client; no exact public result is registered here. | InconnuVision support is not assumed from family branding or an unrelated model variant. | InconnuNo public, comparable sustained Apple Silicon run is registered for this model and Mac configuration. |
Comment lire les étiquettes
- Prise en charge officielle La documentation officielle du modèle/runtime décrit le chemin de capacité ; le comportement exact du client doit encore être vérifié.
- Benchmark public Une évaluation publiée existe, mais ce n'est pas un benchmark de débit ou de flux de travail sur Mac.
- Rapport communautaire Les rapports publics ou artefacts communautaires sont des signaux, pas des tests du projet ni des garanties du fournisseur.
- Inférence système Inférence limitée à partir de l'architecture capacité/runtime, pas un résultat observé.
- Inconnu Aucune preuve publique fiable n'a été recueillie pour cette affirmation précise.
- Vérifié par le projet Seule la combinaison exacte modèle, quantification, runtime et machine du registre de tests du projet est vérifiée.
Apportez votre vraie charge de travail
Transformez les preuves publiques en une décision personnelle.
Le conseiller gratuit ajoute vos exigences actuelles en matière de Mac, de contexte, de simultanéité, de budget, de compatibilité et hors ligne. Il peut indiquer « à vérifier » lorsque les preuves publiques ne suffisent pas.
FAQ
Vérifiez les limites de la preuve avant d’acheter.
S'agit-il d'un benchmark Keep ou Upgrade ?
Non. Un outil de synthèse et de planification des preuves publiques. Seul l'ensemble correct de fumée de projets sera affiché lorsque le projet est vérifié.
Comment calculer la capacité de votre Mac ?
Utilisez la taille de fichier public sélectionnée si le total exact du fichier ou du fichier fractionné est disponible, sinon utilisez l'estimation de planification explicite. Le budget du modèle réserve de la place pour macOS, le runtime et le contexte.
MoE nécessite-t-il moins de mémoire s’il s’agit d’un paramètre valide ?
Non. Les poids complets stockés correspondent à l'état de capacité. Les paramètres valides décrivent uniquement la quantité de calcul par jeton.
La longueur officielle du contexte fonctionne-t-elle sur n'importe quel Mac ?
Non. La longueur du contexte correspond aux métadonnées du modèle. Après le poids, l'exécution, le système et d'autres applications, vous devez également disposer de suffisamment de mémoire sur votre Mac sélectionné.
Pouvez-vous acheter un Mac simplement en regardant le tableau ?
Après avoir affiné votre champ de planification avec cette matrice, entrez votre Mac actuel, votre contexte, votre concurrence, vos clients, votre budget, votre compatibilité et vos exigences hors ligne dans notre conseiller gratuit. La preuve publique ne constitue pas une garantie d’achat.
apporter le travail réel
Utilisez des preuves publiques pour éclairer vos décisions d’achat.
Free Advisor ajoute votre Mac actuel, le contexte, la simultanéité, le budget, la compatibilité, les exigences hors ligne et indique qu'une vérification est requise si les preuves publiques sont insuffisantes.
Keep or Upgrade est un outil indépendant ; Apple ne parraine ni n'approuve cette page.