Windows 11 本地运行 DeepSeek-R1:用 Ollama 安装 7B 模型并验证 API

在 Windows 11 安装 Ollama,运行 DeepSeek-R1 7B,并用 PowerShell 请求本地 Generate API,逐步核对模型、响应与常见失败。

在 Windows 11 上本地运行 DeepSeek-R1 7B,可以先安装 Ollama,再执行 ollama run deepseek-r1:7b。终端能正常回答后,用本机 http://localhost:11434/api/generate 发一次非流式请求;返回中 done 为 true 且 response 不为空,才说明命令行和本地 API 两条路径都已打通。

开始前检查环境和磁盘

Ollama 的 Windows 官方说明写明其以原生 Windows 应用运行,安装后在后台提供命令行和本地 API;当前系统要求页面列出 Windows 10 22H2 或更新版本,因此 Windows 11 在系统版本范围内。页面也提醒模型文件会额外占用较多空间。

Windows 11 本地运行 DeepSeek-R1:用 Ollama 安装 7B 模型并验证 API

  • 确认 Windows 已更新,PowerShell 能正常使用。
  • 确认系统盘或计划存放模型的磁盘有足够剩余空间。
  • 如果有 NVIDIA 或 AMD 显卡,先按官方页面核对当前驱动要求。
  • 关闭包含敏感信息的终端历史记录共享;后面的示例问题不应放入真实隐私数据。

步骤一:安装并确认 Ollama

  1. 从 Ollama 官方 Windows 页面下载并完成安装。
  2. 打开新的 PowerShell 窗口,执行:
ollama --version

预期结果是显示 Ollama 版本,而不是“无法识别命令”。如果安装后找不到命令,先关闭并重新打开 PowerShell;仍失败时检查应用是否启动和安装目录,不要直接进入模型下载步骤。

步骤二:下载并运行 7B 模型

Ollama 的 DeepSeek-R1 模型库页面明确列出了 7B 对应命令:

ollama run deepseek-r1:7b

第一次运行会下载模型。进入对话后输入一个容易核对的问题,例如:

只回答一个数字:17 加 25 等于多少?

预期最终答案应包含 42。这只验证模型能加载并完成一次简单生成,不能证明它适合你的业务,也不是性能测试。退出对话后执行:

ollama list

列表中应出现 deepseek-r1:7b。如果下载中断,先检查网络和磁盘;不要反复启动多个下载进程。

步骤三:用 PowerShell 验证本地 API

Ollama 在 Windows 默认通过 localhost:11434 提供 API。下面请求把 stream 设为 false,便于一次性检查 JSON。接口字段依据 Ollama 的 Generate API 文档。

$body = @{
  model  = "deepseek-r1:7b"
  prompt = "只回答一个数字:17 加 25 等于多少?"
  stream = $false
} | ConvertTo-Json

$result = Invoke-RestMethod `
  -Method Post `
  -Uri "http://localhost:11434/api/generate" `
  -ContentType "application/json" `
  -Body $body

$result.done
$result.response

验收条件是第一行输出 True,第二行有非空回答,并且最终答案能核对。还可以执行 $result.model,确认实际响应模型名。

三个常见失败怎么排查

现象 先检查 通过标准
找不到 ollama 命令 重新打开终端、确认 Ollama 正在运行 ollama --version 有版本号
模型下载失败或磁盘满 网络、剩余空间、模型存储位置 ollama list 出现完整模型
API 拒绝连接 后台应用是否启动、地址是否为 localhost:11434 请求返回 JSON 且 done=True

如果模型能启动但非常慢,先区分“第一次加载慢”和“每次生成都慢”,再观察任务管理器中的 CPU、内存和 GPU 使用。不要仅凭显存一个数字断言故障;模型格式、上下文长度、内存和驱动都会影响运行。

完成后的下一步

把实际 Ollama 版本、模型标签、Windows 版本、驱动、首轮加载时间和简单问题结果记录下来。随后再用自己的脱敏任务建立小型评测集,判断 7B 是否够用。如果资源不足,先减少上下文和并发或选择更小模型;如果答案质量不足,再比较更大模型,不能把“API 返回 200”当成业务质量通过。

本文命令来自官方文档,但没有在你的 Windows 11 电脑上安装或运行,也不保证 7B 在任意硬件上达到某个速度。下载文件大小、驱动要求和模型标签可能变化,执行前应以链接中的当前官方页面为准。

Ai菜鸟网。发布者:AI小管家,转载请注明出处:https://www.alyyhw.com/29726.html

赞 (0)
AI小管家的头像AI小管家
AI芯片推理性能如何评测?固定模型、输入和 Batch 后记录延迟与吞吐量
上一篇 1天前
用 vLLM 部署 DeepSeek-R1-Distill-Qwen-7B:启动 OpenAI 兼容 API 并验证
下一篇 1天前

相关推荐

联系我们

联系我们

1

在线咨询: QQ交谈

邮件:admin@example.com

工作时间:周一至周五,9:30-18:30,节假日休息

关注微信
关注微信
分享本页
返回顶部