在 Windows 11 上本地运行 DeepSeek-R1 7B,可以先安装 Ollama,再执行 ollama run deepseek-r1:7b。终端能正常回答后,用本机 http://localhost:11434/api/generate 发一次非流式请求;返回中 done 为 true 且 response 不为空,才说明命令行和本地 API 两条路径都已打通。
开始前检查环境和磁盘
Ollama 的 Windows 官方说明写明其以原生 Windows 应用运行,安装后在后台提供命令行和本地 API;当前系统要求页面列出 Windows 10 22H2 或更新版本,因此 Windows 11 在系统版本范围内。页面也提醒模型文件会额外占用较多空间。

- 确认 Windows 已更新,PowerShell 能正常使用。
- 确认系统盘或计划存放模型的磁盘有足够剩余空间。
- 如果有 NVIDIA 或 AMD 显卡,先按官方页面核对当前驱动要求。
- 关闭包含敏感信息的终端历史记录共享;后面的示例问题不应放入真实隐私数据。
步骤一:安装并确认 Ollama
- 从 Ollama 官方 Windows 页面下载并完成安装。
- 打开新的 PowerShell 窗口,执行:
ollama --version
预期结果是显示 Ollama 版本,而不是“无法识别命令”。如果安装后找不到命令,先关闭并重新打开 PowerShell;仍失败时检查应用是否启动和安装目录,不要直接进入模型下载步骤。
步骤二:下载并运行 7B 模型
Ollama 的 DeepSeek-R1 模型库页面明确列出了 7B 对应命令:
ollama run deepseek-r1:7b
第一次运行会下载模型。进入对话后输入一个容易核对的问题,例如:
只回答一个数字:17 加 25 等于多少?
预期最终答案应包含 42。这只验证模型能加载并完成一次简单生成,不能证明它适合你的业务,也不是性能测试。退出对话后执行:
ollama list
列表中应出现 deepseek-r1:7b。如果下载中断,先检查网络和磁盘;不要反复启动多个下载进程。
步骤三:用 PowerShell 验证本地 API
Ollama 在 Windows 默认通过 localhost:11434 提供 API。下面请求把 stream 设为 false,便于一次性检查 JSON。接口字段依据 Ollama 的 Generate API 文档。
$body = @{
model = "deepseek-r1:7b"
prompt = "只回答一个数字:17 加 25 等于多少?"
stream = $false
} | ConvertTo-Json
$result = Invoke-RestMethod `
-Method Post `
-Uri "http://localhost:11434/api/generate" `
-ContentType "application/json" `
-Body $body
$result.done
$result.response
验收条件是第一行输出 True,第二行有非空回答,并且最终答案能核对。还可以执行 $result.model,确认实际响应模型名。
三个常见失败怎么排查
| 现象 | 先检查 | 通过标准 |
|---|---|---|
| 找不到 ollama 命令 | 重新打开终端、确认 Ollama 正在运行 | ollama --version 有版本号 |
| 模型下载失败或磁盘满 | 网络、剩余空间、模型存储位置 | ollama list 出现完整模型 |
| API 拒绝连接 | 后台应用是否启动、地址是否为 localhost:11434 | 请求返回 JSON 且 done=True |
如果模型能启动但非常慢,先区分“第一次加载慢”和“每次生成都慢”,再观察任务管理器中的 CPU、内存和 GPU 使用。不要仅凭显存一个数字断言故障;模型格式、上下文长度、内存和驱动都会影响运行。
完成后的下一步
把实际 Ollama 版本、模型标签、Windows 版本、驱动、首轮加载时间和简单问题结果记录下来。随后再用自己的脱敏任务建立小型评测集,判断 7B 是否够用。如果资源不足,先减少上下文和并发或选择更小模型;如果答案质量不足,再比较更大模型,不能把“API 返回 200”当成业务质量通过。
本文命令来自官方文档,但没有在你的 Windows 11 电脑上安装或运行,也不保证 7B 在任意硬件上达到某个速度。下载文件大小、驱动要求和模型标签可能变化,执行前应以链接中的当前官方页面为准。
Ai菜鸟网。发布者:AI小管家,转载请注明出处:https://www.alyyhw.com/29726.html