可以把 Continue 配置为调用本机 Ollama 模型,但“离线”有前提:Ollama、模型文件和 IDE 扩展都要先下载好。Ollama 官方文档说明,本地服务默认通过 http://localhost:11434 提供 API;Continue 文档给出了 provider: ollama 与 apiBase 的配置方式。若组织要求完全断网,还需按组织流程预置安装包和模型。
先确认电脑能运行目标模型
模型能否流畅运行取决于具体模型、量化、上下文长度、可用内存和硬件。本文不按某个显存数字承诺速度或兼容性。先在 Ollama 官方模型库选定一个明确版本,并阅读其大小与要求;下面用 qwen2.5-coder:7b 作为示例标识,实际可用性以模型库和本机资源为准。

安装 Ollama 并下载模型
Windows 用户从 Ollama 官方 Windows 页面安装后,在 PowerShell 执行:
ollama pull qwen2.5-coder:7b
ollama list
ollama list 中出现选定模型后,再确认本机 API 能响应:
Invoke-RestMethod http://localhost:11434/api/tags
如果命令不存在,先检查安装是否完成以及新开的终端是否已读取 PATH;如果模型拉取失败,检查网络、磁盘空间和模型库中实际可用的标签。第一次下载需要联网。
在 Continue 里连接本地服务
先在联网时下载 Continue 扩展安装包,或提前在 VS Code 中安装并确认扩展可启动;完全断网后无法临时从扩展市场安装。随后按 Continue 当前配置界面说明新增模型;配置结构参考其官方 Ollama 页面。简化示例如下,模型字段必须和已下载的标签一致:
name: Local Ollama
version: 0.0.1
schema: v1
models:
- name: Qwen Coder Local
provider: ollama
model: qwen2.5-coder:7b
apiBase: http://localhost:11434
选中该模型后,在一个无敏感内容的小文件里问它“请解释这个函数的输入、输出,并只建议一个小改动”。先查看 Continue 是否显示选中的模型,再检查它返回的修改建议;接受前逐行读差异,并运行项目原有测试。
怎样确认请求走本机
- 配置中的提供方是
ollama,地址是localhost:11434,不是远程主机。 - Ollama API 文档把
http://localhost:11434/api列为本地服务地址;可在本机验证/api/tags返回模型列表。 - 准备好插件和模型后,可断开网络再做一次简单请求,观察请求能否完成。若失败,说明当前流程仍依赖网络资源或服务没有本地运行。
本地推理只说明该模型请求发往本机 Ollama 地址,不能据此推断 Continue、VS Code 或其他扩展完全没有遥测。对保密代码,应按组织策略审查扩展权限、遥测设置和网络出口;受管环境先询问管理员。
边界与故障排查
如果 Continue 报连接失败,依次确认 Ollama 正在运行、地址端口无误、模型标签已下载,再看扩展日志。回答慢或频繁截断时,先减小输入上下文并检查设备资源,不要把“模型可以启动”理解为适合大型仓库。模型文件、扩展版本和配置格式会变化,按本文核验日期及官方文档更新配置。
官方资料
Ai菜鸟网。发布者:AI小管家,转载请注明出处:https://www.alyyhw.com/32358.html