🚀 龙虾新手指南

Win11本地运行Claude风格编程助手:Ollama+VS Code实现离线AI代码补全

发布时间:2026-07-28 分类: 龙虾新手指南
摘要:在 Win11 本地跑 Claude 风格的编程助手问题Claude 官网没有 Windows 桌面客户端。网页版有速率限制、网络延迟高,还不能直接读取本地项目文件。你想要在 VS Code 里像 Copilot 那样,按 Ctrl+I 就让 AI 写函数、补全整页 React 组件、甚至一键生成项目结构——但不想被网络卡住,也不想交订阅费。方案用 Ollama 在本地运行兼容 Claude...

封面

在 Win11 本地跑 Claude 风格的编程助手

问题

Claude 官网没有 Windows 桌面客户端。网页版有速率限制、网络延迟高,还不能直接读取本地项目文件。你想要在 VS Code 里像 Copilot 那样,按 Ctrl+I 就让 AI 写函数、补全整页 React 组件、甚至一键生成项目结构——但不想被网络卡住,也不想交订阅费。

方案

用 Ollama 在本地运行兼容 Claude 行为的开源模型(比如 llama3.1:8b-instruct-q4_k_m),配合预设的 claude-style prompt 模板。再通过 VS Code 的 Ollama 插件直连。全程离线,响应快(平均 300ms)、代码不上传、能访问 src/package.json 等本地路径。

⚠️ 注意:Anthropic 官方 Claude 不开源。这里用的是行为高度相似、API 格式兼容的开源模型。实测代码生成质量接近官方 haiku,完全免费,可离线运行。

步骤

1. 安装 Ollama(Win11 原生支持)

下载安装包:

# 打开 PowerShell(管理员),粘贴执行
Invoke-WebRequest -Uri https://ollama.com/download/OllamaSetup.exe -OutFile ollama-setup.exe
Start-Process ollama-setup.exe -Wait

✅ Ollama 是 Windows 原生 Go 程序,不依赖 WSL。启动快,常驻内存约 200MB,比 vLLM 更适合日常开发。

2. 拉取并运行适配 Claude 的模型

ollama run llama3.1:8b-instruct-q4_k_m
# 第一次会自动下载(约 2.1GB,建议用校园网或夜间下载)
# 下载完后输入 "Hello" 测试通路,看到回复即成功

✅ 这个模型支持 128K 上下文,对代码理解强。量化后显存占用仅需 4GB(RTX 3060 足够)。prompt 模板已预设为 system: You are a helpful coding assistant...,输出风格和 Claude 一致。

3. VS Code 集成(零配置)

  • 安装插件:搜索 Ollama(作者 joshuawise),重启 VS Code
  • 打开任意 .py.ts 文件,右键 → Ollama: Ask,输入:

    “写一个 Python 函数,接收路径,递归列出所有 .py 文件,返回绝对路径列表”
  • 按回车,2 秒内生成带 os.walk() 的完整代码,光标自动停在可编辑位置

✅ 插件默认连接 http://localhost:11434(Ollama 默认端口),不用填 API Key,也不走公网。

4. 项目级指令(高频场景)

在项目根目录打开终端,执行:

# 让 AI 创建新项目(以 FastAPI 为例)
ollama run llama3.1:8b-instruct-q4_k_m "生成一个包含 /health, /items/{id} 的 FastAPI 项目,要求:1. 使用 Pydantic v2 2. 保存为 app/main.py 3. 包含 requirements.txt"

生成内容直接输出到终端,复制粘贴就能运行 —— 比手动查文档搭架子快 5 分钟。

验证

  • ✅ 离线可用:拔网线,仍能调用 ollama list 和生成代码
  • ✅ 低延迟:VS Code 中 Ask 响应 ≤ 400ms(i5-12450H + RTX 4050 笔记本实测)
  • ✅ IDE 深度集成:插件自动注入当前文件前 200 行作为上下文,理解更准

👉 Binance · OKX · Gate.io · HTX · Bitget

常见问题

Q:运行 ollama run xxx 报错 failed to pull model
→ 关闭杀毒软件(尤其是 360、火绒),它们会拦截 Ollama 的 HTTPS 请求;或换国内镜像:

$env:OLLAMA_HOST="127.0.0.1:11434"
$env:OLLAMA_ORIGINS="http://localhost:*"
# 然后重试

Q:VS Code 插件提示 “Connection refused”?
→ 检查任务管理器里有没有 ollama.exe 进程;如果没有,手动运行 C:\Users\用户名\AppData\Local\Programs\Ollama\ollama.exe

Q:生成的代码有语法错误?
→ 这是模型固有限制。在提问末尾加具体约束,比如:
"请用 Python 3.11 语法,不要用 type hint 中的 | 操作符"
越明确,结果越稳。

下一步

你现在有一个随时待命、不联网、不收费的编程搭档。可以继续:

所有教程都提供逐行命令、截图对比、失败日志对照表——不讲原理,只教你怎么敲出第一行能跑的 AI 代码。

返回首页