Ollama 运行 DeepSeek 长时间没有输出时,先判断是服务没启动、模型仍在下载、模型装不下,还是已经开始生成但速度很慢。按下面顺序排查,每一步都有明确结果,避免反复重装。
第一步:确认服务和模型
ollama list
ollama ps
curl http://localhost:11434/api/tags
ollama list 应出现你实际运行的完整模型标签;curl 应返回 JSON。若端口无法连接,先重启 Ollama,而不是重新下载模型。命令含义可对照Ollama CLI 官方文档。

若第一次运行还在拉取文件,观察下载进度和剩余磁盘。不要同时启动多个大模型。
第二步:用最小请求区分“慢”和“无响应”
curl http://localhost:11434/api/chat -d '{
"model": "deepseek-r1:1.5b",
"messages": [{"role":"user","content":"只回答:连接正常"}],
"stream": false,
"options": {"num_ctx": 2048}
}'
Windows PowerShell 建议把 JSON 保存成文件后用 curl.exe --data-binary @request.json,避免引号被 shell 改写。小模型能返回而大模型不返回,重点检查内存和模型大小;所有模型都连不上,则回到服务和端口。
第三步:看加载位置和系统资源
再次运行 ollama ps,记录 PROCESSOR、上下文长度和模型是否仍在列表。任务管理器或 top 中内存持续接近上限并大量使用交换空间,通常会表现为极慢。先退出其他模型,把上下文降到 2048,再换更小标签测试。
DeepSeek-R1 模型页列出了不同参数版本及下载体积。文件能下载完成并不代表运行时内存一定足够;上下文缓存和运行开销还会继续占用内存。
第四步:读取对应系统日志
官方故障排查页列出各系统日志位置。Windows 可先查看 %LOCALAPPDATA%\Ollama\server.log,Linux 服务可执行:
journalctl -u ollama --no-pager --since "10 minutes ago"
搜索 out of memory、端口占用、模型文件损坏或 GPU 初始化失败。修复后重复同一最小请求;只有返回正文且日志没有新增致命错误,才算恢复。
何时不要继续等待
如果系统开始频繁换页、接口超过数分钟没有任何字节、日志反复出现同一内存错误,继续等待通常不会改善。本文未在你的电脑上复现故障;请保留模型标签、操作系统、内存/GPU、请求和最后 30 行脱敏日志,才能进一步定位。
Ai菜鸟网。发布者:AI小管家,转载请注明出处:https://www.alyyhw.com/32388.html