需安装ollama框架、下载deepseek-r1模型(如1.5b/7b/14b)、配置ollama_host和ollama_origins环境变量并重启,再通过chatbox连接http://localhost:11434/v1/实现离线图形化运行。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

想在Windows电脑上离线运行DeepSeek模型,摆脱网页版“服务器繁忙”提示、避免对话数据上传云端,就得完成本地部署——这要求你装好Ollama框架、下载指定版本的deepseek-r1模型、再配一个图形界面让操作不靠命令行。
安装Ollama运行环境
打开浏览器,访问 https://www.php.cn/link/2575c857df983996d49550f3e924755f,点击 Windows 版本下载按钮。下载完成后,右键安装包 → 选择“以管理员身份运行”,全程默认下一步即可。安装过程会自动注册系统服务和环境变量,无需手动干预。
安装结束时桌面会出现一只羊驼图标,说明后台服务已启动。按 Win + R 输入 cmd 回车,在命令行中执行 ollama list,若返回空列表(无报错)即表示安装成功。如果提示“不是内部或外部命令”,说明环境变量未生效,需重启命令行或电脑。
下载并运行DeepSeek-R1模型
根据你的显卡和内存配置选模型:GTX 1050 / RTX 3050(4GB显存)起步可跑 1.5b;RTX 4060(8GB)建议 7b;RTX 4090(24GB)可尝试 14b。不推荐直接拉 32b 及以上版本,Windows下容易触发OOM崩溃。
以管理员身份打开命令提示符,输入以下任一命令开始下载:
方法一(最轻量,适合入门):
ollama run deepseek-r1:1.5b
方法二(平衡性能与资源):
ollama run deepseek-r1:7b
方法三(需高配,响应更稳):
ollama run deepseek-r1:14b
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
首次运行会自动下载模型文件(1.5b约3.8GB,7b约13GB),国内用户若卡在“Downloading…”阶段,【务必关闭杀毒软件实时防护】,否则Ollama会被拦截导致下载中断且不报错。下载完成后终端显示 success 并进入交互界面,输入 help 可测试基础响应。
配置远程访问支持图形客户端
Ollama默认只允许本地回环调用,ChatBox等图形工具连不上是因为它监听的是 127.0.0.1:11434,而图形客户端需要跨进程通信。必须改两个系统级环境变量才能打通。
第一步:右键“此电脑”→属性→高级系统设置→环境变量→系统变量→新建
变量名:OLLAMA_HOST,变量值:0.0.0.0
第二步:再新建一个系统变量
变量名:OLLAMA_ORIGINS,变量值:*
第三步:保存后【必须彻底关闭所有命令行窗口,并重启电脑】,否则新变量不会被Ollama服务读取。重启后在任务管理器“服务”页确认 ollama 状态为“正在运行”。
接入ChatBox图形界面
访问 https://www.php.cn/link/8ee36dbf789f7ae06cfc49e0e33325ec 下载 Windows 安装包,双击运行,安装路径建议选非C盘(如D:\ChatBox),避免后续模型缓存挤占系统盘空间。
安装完成后打开ChatBox,点击左下角齿轮图标进入设置 → 模型设置 → API类型选“Ollama API” → API地址填 http://localhost:11434/v1/ → 模型名称输入你下载的完整标识,例如 deepseek-r1:1.5b → 点击“检查连接”。
若状态显示绿色“Connected”,说明链路通了;若提示“Connection refused”,请立刻检查:① Ollama服务是否运行;② 是否重启过电脑;③ 模型名称是否拼写完全一致(包括冒号和小写字母)。确认无误后,在主界面左上角模型下拉框中手动选择该模型,即可开始对话。










