Mac 本地部署 DeepSeek 可以用 Ollama 完成。先确认 macOS 和芯片满足当前 Ollama 要求,再从小模型开始,最后用 ollama ps 检查模型是否通过 Metal 使用 GPU。
安装并确认服务
从Ollama macOS 官方文档进入下载页,把应用放入 Applications 后启动。不要从不明“整合包”导入模型。打开终端执行:

ollama --version
curl http://localhost:11434/api/tags
版本命令应返回版本号,API 应返回 JSON。若系统拦截应用,先核对签名和下载来源,不要关闭所有安全检查。
按统一内存选择模型
Apple 芯片使用统一内存,模型、上下文、系统和其他应用会共享它。8GB 或正在运行多个应用时先用:
ollama pull deepseek-r1:1.5b
ollama run deepseek-r1:1.5b
内存更充足再逐级测试 7B、8B 或 14B;各标签体积以官方模型页为准。不要仅凭参数量推断一定装得下。
检查 Metal 加速
模型回答期间另开终端:
ollama ps
查看 PROCESSOR 是否显示 GPU 或 CPU/GPU 分配,并用“活动监视器”观察内存压力。GPU 支持文档说明 Apple GPU 通过 Metal 加速。如果只显示 CPU,先确认不是 Intel Mac、系统版本过旧或当前模型刚好没有卸载到 GPU。
用真实任务验收
- 准备一段不含敏感信息的 300 字会议记录。
- 要求模型输出负责人、截止日、待办三列。
- 逐项对照原文,记录首字等待、总耗时和错误项。
- 换大模型时保持输入与上下文相同,只有质量提升值得额外资源才保留。
常见问题
出现内存压力红色或系统频繁换页时,退出其他大应用、降低上下文或换小模型。模型列表存在但接口不通时,重启 Ollama 并查看应用日志。本文依据官方文档提供操作路径,没有在你的 Mac 型号和系统版本上实测;Intel Mac 与 Apple 芯片的性能和加速能力不能混为一谈。
Ai菜鸟网。发布者:AI小管家,转载请注明出处:https://www.alyyhw.com/32406.html