入门Mac / 苹果 6 分钟阅读

Mac M3 Pro:实际模型运行极限

18GB 或 36GB 统一内存下,Ollama 和 llama.cpp 实际能跑什么。

已验证技术栈

M3 Pro 18/36GB · Ollama Metal · 7–14B Q4 · 18GB 避免 32B

最近验证 2026-07-22

MacM3 ProOllamaUnified Memory

18GB M3 Pro

坚持 7–8B Q4 模型。除非接受极短上下文,否则避免 14B+。

text
✓ Llama 3.1 8B Q4_K_M (ctx 8K)
✓ Qwen2.5 7B Q4_K_M
✗ Qwen2.5 14B Q4_K_M (needs 36GB+)

36GB M3 Pro

14B Q4_K_M + 8K 上下文运行良好。32B 需 Q3 或大幅缩减上下文。

bash
ollama pull qwen2.5:14b
ollama run qwen2.5:14b

接下来

看看 🍎 Mac M3 Pro 18G 还能跑哪些模型反向查询 —— 18GB、8192 上下文,按质量排序

本文涉及的模型

相关指南

部署指南仅供学习参考。每个模型均有独立许可协议 — 下载或部署前请阅读 Hugging Face 官方模型卡。