Windows 用 Ollama + Open WebUI 搭建本地 AI 助手教程

Windows Ollama Open WebUI local AI assistant cover image

开头说明

如果你想在自己的 Windows 电脑上搭建一个本地 AI 助手,可以用 Ollama 运行本地模型,再用 Open WebUI 提供类似 ChatGPT 的网页界面。这样家里电脑、手机、平板都可以在局域网里访问同一个 AI 助手。

这套方案适合旧电脑再利用、本地 AI 入门、学习大模型部署,也适合不想每次都把普通文本发到云端的用户。需要注意,本地 AI 的速度和效果取决于电脑配置和模型大小,不要期待一台很老的电脑直接达到云端旗舰模型效果。

项目地址

整体思路

  • Windows 安装 Ollama,用来下载和运行本地 AI 模型。
  • Windows 安装 Docker Desktop,用来部署 Open WebUI。
  • Open WebUI 连接本机 Ollama。
  • 浏览器打开 Open WebUI,像使用 ChatGPT 一样使用本地模型。
  • 如果需要局域网访问,再配置 Windows 防火墙和固定 IP。

电脑配置建议

配置建议
CPU普通办公电脑也能跑小模型,核心越多越好
内存8GB 可以体验小模型,16GB 更舒服,32GB 更适合多模型
显卡不是必须,有 NVIDIA 显卡会更快
硬盘建议预留 20GB 到 100GB,模型会占空间
系统Windows 10/11

没有显卡也可以跑,只是速度慢一些。新手建议先从小模型开始,不要一上来就下载几十 GB 的大模型。

第一步:安装 Ollama

打开 Ollama 官方网站,下载 Windows 安装包并安装。

https://ollama.com/download

安装完成后,打开 PowerShell,检查 Ollama 是否可用:

ollama --version

第二步:下载并运行一个模型

新手可以先用体积适中的模型测试。下面命令会自动下载模型并运行:

ollama run llama3.1:8b

如果电脑配置较低,也可以选择更小的模型,例如:

ollama run qwen2.5:3b

进入对话后,随便问一句中文问题测试:

请用中文解释一下什么是本地大模型。

如果能正常回答,说明 Ollama 已经可以运行。退出对话可以输入:

/bye

第三步:查看已安装模型

ollama list

如果以后想删除不用的模型,可以执行:

ollama rm 模型名称

第四步:安装 Docker Desktop

Open WebUI 推荐用 Docker 部署。Windows 上可以安装 Docker Desktop。

https://www.docker.com/products/docker-desktop/

  • 下载 Docker Desktop for Windows。
  • 安装时保持 WSL 2 相关选项开启。
  • 安装完成后重启电脑。
  • 打开 Docker Desktop,等待 Docker 正常运行。

检查 Docker:

docker version
docker compose version

第五步:用 Docker 部署 Open WebUI

如果 Ollama 安装在 Windows 本机,Open WebUI 用 Docker 运行,可以使用下面命令:

docker run -d -p 3000:8080 --add-host=host.docker.internal:host-gateway -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:main

命令说明:

  • 3000:8080:把 Open WebUI 映射到本机 3000 端口。
  • host.docker.internal:让 Docker 容器访问 Windows 本机上的 Ollama。
  • open-webui:/app/backend/data:保存 Open WebUI 的用户和设置数据。
  • –restart always:电脑重启后容器自动启动。

第六步:打开 Open WebUI

浏览器打开:

http://localhost:3000

第一次打开需要创建管理员账号。创建完成后,Open WebUI 会连接 Ollama,你就可以在网页里选择本地模型对话。

第七步:局域网访问

如果你希望家里其他设备也能访问,比如手机、平板、另一台电脑,可以先查看 Windows 电脑的局域网 IP:

ipconfig

假设 IPv4 地址是:

192.168.1.50

那么其他设备访问:

http://192.168.1.50:3000

如果打不开,通常是 Windows 防火墙拦截了 3000 端口,可以添加 TCP 3000 的入站规则。

第八步:推荐新手模型

模型适合场景
qwen2.5:3b低配置电脑体验中文对话
qwen2.5:7b中文问答、写作、轻量办公
llama3.1:8b通用英文和中文任务
mistral:7b轻量通用模型体验
gemma2:9b通用问答和写作测试

模型名称和版本会变化,下载前可以到 Ollama 模型库查看当前可用模型。

https://ollama.com/library

第九步:常用 Ollama 命令

命令作用
ollama run 模型名下载并运行模型
ollama list查看本机已有模型
ollama rm 模型名删除模型
ollama ps查看正在运行的模型
ollama pull 模型名只下载模型,不进入对话

第十步:日常使用建议

  • 低配置电脑先用 3B 或 7B 模型,不要一开始就上大模型。
  • 本地模型适合草稿、总结、改写、简单代码,不适合盲目信任事实答案。
  • 重要答案仍然需要自己核对来源。
  • 不要把 Open WebUI 直接暴露到公网。
  • 如果家里多人使用,建议每个人单独账号。

第十一步:外网访问要谨慎

Open WebUI 里可能保存对话记录和个人资料,不建议直接在路由器上开放端口。如果确实需要外网访问,可以考虑 Cloudflare Tunnel,并加上 Cloudflare Access 登录保护。

Cloudflare Tunnel 官方文档:https://developers.cloudflare.com/cloudflare-one/networks/connectors/cloudflare-tunnel/

外网访问安全建议:

  • 不要开放裸奔端口。
  • 不要使用简单密码。
  • 不要把管理员账号分享给别人。
  • 建议开启额外访问验证。
  • 不需要外网访问时,只保留局域网访问。

常见问题

1. 没有显卡能用吗?

可以。没有显卡也能用 CPU 跑小模型,只是速度会慢。建议先试 qwen2.5:3b 这类小模型。

2. 为什么回答很慢?

本地 AI 速度取决于 CPU、内存、显卡和模型大小。模型越大,对电脑要求越高。

3. Open WebUI 打不开怎么办?

先检查 Docker Desktop 是否运行,再执行:

docker ps

如果没有 open-webui 容器,重新执行 Docker 运行命令。

4. Open WebUI 连接不到 Ollama 怎么办?

确认 Ollama 已经安装并能在 PowerShell 里运行模型。Docker 命令里要保留 –add-host=host.docker.internal:host-gateway。

5. 模型占用空间太大怎么办?

用 ollama list 查看模型,再删除不用的模型:

ollama rm 模型名称

总结

Windows 用 Ollama + Open WebUI 搭建本地 AI 助手并不复杂。Ollama 负责运行模型,Open WebUI 负责提供网页界面,Docker Desktop 负责部署和管理服务。

这套方案最适合本地 AI 入门、旧电脑再利用、局域网家庭使用和轻量办公测试。新手先跑通小模型,再慢慢尝试更大的模型和更复杂的工作流。

参考资料

发表评论

您的邮箱地址不会被公开。 必填项已用 * 标注

滚动至顶部