需依次完成五步配置:一、确认ollama服务运行且deepseek模型已加载;二、在工作区设置中将deepseek指定为ollama聊天模型并启用query模式;三、全局配置nomic-embed-text为嵌入模型;四、上传文档并等待状态变为ready;五、通过文档相关问题验证检索与推理链路是否畅通。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您已在本地部署Ollama与DeepSeek R1模型,但无法在AnythingLLM中调用其进行知识问答或文档推理,则可能是由于模型连接未正确配置、嵌入引擎缺失或工作区未绑定对应能力。以下是实现DeepSeek作为AnythingLLM“本地大脑”的完整操作路径:
一、确认Ollama服务与DeepSeek模型已就绪
该步骤确保底层推理引擎处于可调用状态。AnythingLLM依赖Ollama HTTP API(默认端口11434)发现并请求模型,若服务未运行或模型未加载,后续所有配置将失效。
1、打开命令行工具(PowerShell或CMD),执行ollama list,确认输出中包含类似deepseek-r1:7b或deepseek-r1:1.5b的条目。
2、执行curl http://127.0.0.1:11434/api/tags(需安装curl)或在浏览器访问http://127.0.0.1:11434/api/tags,验证Ollama API返回JSON响应且包含deepseek模型信息。
3、若API无响应,右键任务栏Ollama图标,选择Restart Ollama;若仍失败,重启电脑后重试。
二、在AnythingLLM中配置DeepSeek为工作区聊天模型
此步骤将DeepSeek指定为当前工作区的主推理模型,使其承担问答生成、逻辑推演等核心“大脑”职能。必须在具体工作区内完成设置,全局设置不生效。
1、启动AnythingLLM客户端,点击左侧+按钮创建工作区,输入名称(如“技术笔记大脑”)并保存。
2、进入该工作区后,点击右上角齿轮图标,打开Workspace Settings。
3、在LLM Preferences区域,将Provider下拉菜单设为Ollama。
4、在Ollama Model字段中,从下拉列表选择已安装的DeepSeek模型(如deepseek-r1:7b)。
5、将Chat Mode设为Query(启用RAG检索增强),确保模型能结合上传文档作答。
6、滚动至底部,点击Save Changes,等待页面提示Settings saved successfully。
三、配置向量嵌入模型以支撑语义理解
DeepSeek作为“大脑”负责生成答案,但需依赖向量模型将文档转化为机器可理解的数学表示。若未配置嵌入模型,上传的PDF、TXT等内容无法被索引,导致问答时无法引用知识库内容。
1、点击AnythingLLM左下角⚙️ Settings全局设置图标。
2、切换至Embedder Preferences标签页。
统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。
3、将Embedding Provider设为Ollama。
4、在Ollama Embedding Model下拉框中,选择nomic-embed-text;若未出现,需先在终端执行ollama pull nomic-embed-text下载。
5、勾选Use this embedder for all workspaces,确保所有工作区统一使用该嵌入能力。
6、点击Save Changes,系统将自动重启嵌入服务。
四、上传文档并触发向量化处理
此步骤将原始资料注入知识库,经向量模型编码后存入本地向量数据库,为DeepSeek提供可检索的上下文依据。仅上传不触发处理将导致文档“存在但不可用”。
1、回到已配置DeepSeek的工作区界面,点击顶部Upload Documents按钮。
2、拖拽PDF、TXT、MD等文件至上传区域,或点击Browse Files手动选取。
3、上传完成后,文档列表显示Status: Processing,此时AnythingLLM正调用nomic-embed-text进行分块与向量化。
4、待状态变为Status: Ready,说明文档已成功嵌入,可被DeepSeek实时调用。
5、点击任意文档右侧⋯菜单,选择View Embeddings,确认向量维度(如768维)与chunk数量非零。
五、验证本地大脑是否正常运转
该步骤通过实际问答检验整个链路:用户输入→向量检索→DeepSeek推理→结果生成。任一环节中断均表明配置存在隐性缺陷。
1、在工作区聊天窗口输入明确基于上传文档的问题,例如:“根据《Python并发编程指南.pdf》第12页,asyncio.create_task()的作用是什么?”。
2、观察左侧Context Sources面板是否动态展开,显示匹配的PDF片段及高亮关键词。
3、检查回答内容是否准确引用文档原文,而非通用网络知识;若出现“I don't know”或泛泛而谈,说明检索未命中或模型未聚焦上下文。
4、若首次问答失败,在聊天框输入/debug指令,查看系统日志中是否报错ollama connection refused或embedding model not found。










