Fit check
내 Mac에서 로컬 LLM이 돌아갈까? 모델별 메모리 적합성 확인
로컬 AI용 Mac 구매 전 가장 흔한 질문에 직접 답합니다: 이 모델이 이 기기에 실제로 들어갈까요? 표는 적합성 탐색기와 동일한 용량 계산(공개 가중치 크기 대 사용 가능 통합 메모리)을 사용해 현재 각 모델의 최소 Mac 구성을 보여줍니다.
짧은 결론
Mac에서 로컬 모델을 돌리려면 저장된 가중치가 macOS·런타임·컨텍스트 예약을 뺀 사용 가능 통합 메모리 안에 들어가야 합니다. 계획 기준: 통합 메모리의 약 75%를 사용 가능로 보고, 4GB를 런타임과 컨텍스트에 남기며, 4비트 양자화는 10억 파라미터당 약 0.6GB이 필요합니다. 이 계산을 넘어서는 속도와 작업 흐름의 문제이지 용량의 문제가 아닙니다.
현재 각 모델의 최소 Mac 구성
각 행은 적합 엔진과 동일한 용량 계산을 사용합니다: 사용 가능 메모리는 통합 메모리의 75%에서 4GB 런타임·컨텍스트 예약을 뺀 값이고, 남은 것이 4GB 미만이면 '빠듯함'입니다. '여유가 있는 첫 구성'은 적합성 탐색기의 구매 결정 카드와 같은 기준입니다. 모델 이름을 누르면 대화형 탐색기에서 열립니다.
| 모델 | 가중치(양자화) | 들어가는 최저 구성 | 여유가 있는 첫 구성 | 16GB Mac mini M6 |
|---|---|---|---|---|
| Qwen3.8 27B (27B) | 16.06GB · 검증된 파일 크기 (Q4_0) | Mac mini M6 · 32GB · 빠듯함 · 3.94GB GB 여유 | Mac mini M5 Pro · 48GB · 15.94GB GB 여유 | 들어가지 않음 |
| Qwen3.8-Flash-Next 180B (6B active) (180B total · 6B active) | 360GB · 검증된 파일 크기 (BF16) | Mac Studio M5 Ultra · 512GB · 여유 있음 · 20GB GB 여유 | Mac Studio M5 Ultra · 512GB · 20GB GB 여유 | 들어가지 않음 |
| Qwen3.8 2.4T-A95B (2400B total · 95B active) | 1440GB · 계획 추정 (Q4_K_M) | 카탈로그 내 Mac으로는 부족합니다 | — | 들어가지 않음 |
| DeepSeek-V4-Flash 284B-A13B (284B total · 13B active) | 170.4GB · 계획 추정 (MLX-4bit) | Mac Studio M5 Ultra · 256GB · 여유 있음 · 17.6GB GB 여유 | Mac Studio M5 Ultra · 256GB · 17.6GB GB 여유 | 들어가지 않음 |
| DeepSeek-V4-Pro 1.6T-A49B (1600B total · 49B active) | 960GB · 계획 추정 (MLX-4bit) | 카탈로그 내 Mac으로는 부족합니다 | — | 들어가지 않음 |
| GLM-5.3-Flash 320B-A18B (320B total · 18B active) | 203.99GB · 검증된 파일 크기 (MLX-4bit) | Mac Studio M5 Ultra · 512GB · 여유 있음 · 176.01GB GB 여유 | Mac Studio M5 Ultra · 512GB · 176.01GB GB 여유 | 들어가지 않음 |
| GLM-5.3 744B-A40B (744B total · 40B active) | 446.4GB · 계획 추정 (MLX-4bit) | 카탈로그 내 Mac으로는 부족합니다 | — | 들어가지 않음 |
| Gemma 4 E2B (5.1B) | 3.35GB · 검증된 파일 크기 (Q4_0) | Mac mini M6 · 16GB · 여유 있음 · 4.65GB GB 여유 | Mac mini M6 · 16GB · 4.65GB GB 여유 | 여유 있음 |
| Gemma 4 12B Unified (11.95B) | 6.98GB · 검증된 파일 크기 (Q4_0) | Mac mini M6 · 16GB · 빠듯함 · 1.02GB GB 여유 | Mac mini M6 · 24GB · 7.02GB GB 여유 | 빠듯함 |
| Gemma 4 26B-A4B (25.2B total · 3.8B active) | 14.44GB · 검증된 파일 크기 (Q4_0) | Mac mini M6 · 32GB · 여유 있음 · 5.56GB GB 여유 | Mac mini M6 · 32GB · 5.56GB GB 여유 | 들어가지 않음 |
적합성 계산 원리
- 저장된 가중치가 용량 관문입니다. 모델 파일이 먼저 메모리에 들어가지 않으면 나머지는 무의미합니다. MoE 모델은 저장 패키지 전체로 계산하며 활성 파라미터가 요구량을 줄이지 않습니다.
- 사용 가능 메모리는 표기보다 적습니다. 통합 메모리의 75%를 모델에 배정하고 4GB를 macOS·런타임·실용 컨텍스트에 남깁니다. 16GB Mac은 가중치를 약 8GB로 계획합니다.
- '빠듯함'과 '여유'를 분리합니다. 가중치 뒤 남은 것이 4GB 미만이면 긴 프롬프트, 에이전트, 동시 작업이 경계를 넘을 수 있어 해당 구성은 여유가 아니라 빠듯함으로 표시합니다.
답이 '아니오'일 때
모델이 들어가지 않으면 더 빠른 칩도 답을 바꾸지 못합니다. 관문은 메모리입니다. 비용이 낮은 순서로: 같은 모델의 더 작은 양자화, 용도를 만족하는 더 작거나 증류 모델, 또는 해당 작업은 클라우드 API에 두고 Mac에는 들어가는 모델만 놓기. Mac 런타임 근거가 아직 검증되지 않은 모델 하나 때문에 최대 메모리 Mac Studio를 사지 마세요. 런타임 근거를 먼저 확인하세요.
대화형 도구
내 구성을 확인하세요.
모델·양자화·런타임을 고르면 가중치 예산, 남은 메모리, 무료 사기/유지/기다리기 Advisor로 가는 다음 단계가 표시됩니다.
자주 묻는 질문
용량의 경계를 먼저 확인하세요.
16GB Mac에서 70B 모델이 돌아갈까요?
아니오. 70B 모델의 4비트 양자화는 약 42GB의 가중치를 저장하지만, 16GB Mac의 계획 예산은 시스템·런타임·컨텍스트 예약 후 약 8GB입니다. 속도 문제가 아니라 가중치가 들어가지 않는 것입니다. 32B 모델의 Q4(약 20GB)도 32GB Mac에서는 예약 후 빠듯합니다.
MoE 활성 파라미터면 메모리가 줄어드나요?
아닙니다. 전문가 혼합 모델도 모든 전문가를 메모리에 저장합니다. 활성 파라미터는 토큰당 계산량을 설명할 뿐 용량이 아닙니다. 284B-A13B 모델은 13B 활성 값보다 훨씬 많은 메모리가 필요합니다.
'여유 있게 들어감'은 잘 돌아간다는 보장인가요?
아닙니다. 적합성은 가중치가 메모리 예산에 들어가는지만 답합니다. 프리필 속도, 긴 컨텍스트, 도구 호출, 동시 실행, 지속 동작은 정확한 모델, 런타임(MLX, Ollama, llama.cpp), 클라이언트에 따라 별도 확인이 필요합니다.
2026년 로컬 LLM용 Mac은 무엇을 사야 하나요?
칩 이름이 아니라 모델에서 시작하세요. 위 표에서 여유 있는 최소 구성을 찾고, 컨텍스트 길이·동시 실행·예산을 무료 Advisor에 넣으세요. 전체 비교 가이드가 Mac mini M6, M5 Pro, Mac Studio를 작업별로 비교합니다.
가중치 크기는 검증되었나요?
'검증된 파일 크기' 표시 행은 공식 또는 커뮤니티 저장소의 정확한 공개 바이트 수를 사용하며 2026-08-28에 확인했습니다. '계획 추정' 표시 행은 10억 파라미터당 0.6GB 규칙을 사용하며 정확한 파일을 읽기 전까지 추정으로 둡니다.
실제 작업 가져오기
용량 결론을 구매 판단으로.
무료 Advisor는 현재 Mac, 컨텍스트, 동시 실행, 예산, 호환성, 오프라인 요구를 추가합니다. 용량은 판단의 일부일 뿐입니다.
Keep or Upgrade는 독립적인 의사결정 지원 도구이며 Apple의 후원을 받지 않습니다.