不写代码实现智能检索:n8n + 向量数据库实战指南

云萱君_3940

云萱君_3940

2025-11-26

820人浏览

原创

n8n + pinecone + modelscope:知识库向量查询工作流实战

前言

在构建智能知识库系统时,如何快速实现语义检索是个核心问题。本文记录了使用 n8n 搭建知识库查询工作流的完整过程,采用 modelscope 生成文本向量,通过 pinecone 进行相似度检索,整个流程通过 webhook 对外提供 api 服务。

这套方案的优势在于无需编写后端代码,通过可视化节点编排就能实现企业级的向量检索服务,适合快速验证技术方案或为现有系统增加智能检索能力。

环境准备

需要提前准备以下资源:

n8n 实例:已部署并可通过域名访问(本文使用 https://your-n8n-domain.com)ModelScope API:用于生成文本 Embedding,需要申请 API KeyPinecone 向量数据库:已创建索引,记录下 API URL 和 KeyAPI 密钥管理:准备一个用于验证请求来源的密钥(如 your-secret-api-key

确保 n8n 已配置好 Header Auth 凭证,分别添加 ModelScope 和 Pinecone 的认证信息。

工作流设计

整个查询流程分为五个核心环节:接收查询请求、验证身份、生成查询向量、执行向量检索、格式化返回结果。下面通过实际配置来展示每个节点的作用。

创建 Webhook 接收请求

在 n8n 中新建工作流,第一个节点选择 Webhook,配置如下关键参数:

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

不写代码实现智能检索:n8n + 向量数据库实战指南
创建Webhook节点

HTTP 方法选择 POST,路径设置为 knowledge/query,这样生成的完整 URL 就是 https://your-n8n-domain.com/webhook/knowledge/query。需要注意的是,响应方式必须选择 "使用 Respond to Webhook 节点",否则会在节点执行完就立即返回,无法控制最终的响应内容。

Webhook 验证选择 None,因为我们会在后续节点中手动验证 API Key,这样能更灵活地控制错误返回格式。

验证 API Key

为了防止接口被滥用,需要验证请求头中的密钥。添加一个 If 节点,从 Webhook 的输出中提取 x-api-key 请求头进行比对:

不写代码实现智能检索:n8n + 向量数据库实战指南
验证API Key

条件配置为:{{ $json.headers['x-api-key'] }} 等于 your-secret-api-key(替换为你自己的密钥)。如果验证失败,连接到一个 Respond to Webhook 节点返回 401 错误:

不写代码实现智能检索:n8n + 向量数据库实战指南
返回401错误

响应格式选择 JSON,内容设置为:

<code class="json">{  "error": "Unauthorized",  "message": "无效的 API Key"}</code>

响应代码填写 401。这样当密钥错误时,调用方能清晰地知道问题所在,而不是收到模糊的执行失败提示。

生成查询向量

验证通过后,需要调用 ModelScope 的 Embedding 接口,将用户的查询文本转换为向量。添加一个 HTTP Request 节点:

不写代码实现智能检索:n8n + 向量数据库实战指南
调用ModelScope生成Embedding

关键配置项:

Miller CSV TSV JSON 数据处理器
Miller CSV TSV JSON 数据处理器

Miller (mlr) 是一个命令行工具,用于查询、整形和重新格式化名称索引数据,如 CSV、TSV、JSON 和 JSON Lines。它将 awk、sed、cut、join 和 sort 的功能整合到一个专为结构化数据处理而构建的单一工具中。

下载
URL:https://api-inference.modelscope.cn/v1/embeddings认证方式:选择之前配置的 ModelScope API 凭证(Header Auth)请求体:
<code class="json">{    "model": "Qwen/Qwen3-Embedding-0.6B",    "input": "{{ $json.body.query }}",    "encoding_format": "float"}</code>

这里从 Webhook 请求体中提取 query 字段作为输入文本。ModelScope 会返回一个包含向量数组的 JSON 响应,数据嵌套在 data.data[0].embedding 路径下。

格式化查询参数

拿到向量后,需要转换成 Pinecone 接受的查询格式。添加一个 Code 节点,使用 JavaScript 处理数据:

不写代码实现智能检索:n8n + 向量数据库实战指南
格式化查询参数
<code class="javascript">const responseData = JSON.parse($input.first().json.data);const embedding = responseData.data[0].embedding;const topK = $('查询请求').first().json.body.top_k || 3;return [{  json: {    vector: embedding,    topK: topK,    includeMetadata: true,    includeValues: false  }}];</code>

这段代码做了三件事:解析 ModelScope 返回的数据、提取向量数组、构造 Pinecone 查询对象。topK 参数允许调用方指定返回结果数量,默认为 3。includeMetadata 设置为 true 可以拿到文档的元数据(文件名、分块索引、上传时间等),而 includeValues 设置为 false 能减少响应体积。

执行向量检索

添加 HTTP Request 节点调用 Pinecone 的查询接口:

不写代码实现智能检索:n8n + 向量数据库实战指南
Pinecone向量查询

配置 POST 请求到你的 Pinecone 索引地址,格式类似 https://your-index-name.svc.region.pinecone.io/query。请求体引用上一步的输出:

<code class="json">{  "vector": "{{ $json.vector }}",  "topK": "{{ $json.topK }}",  "includeMetadata": "{{ $json.includeMetadata }}",  "includeValues": "{{ $json.includeValues }}"}</code>

Pinecone 会返回最相似的 K 个文档,每个结果包含文档 ID、相似度得分和元数据。

格式化输出结果

Pinecone 的原始响应格式对前端不够友好,需要再次转换。添加 Code 节点:

不写代码实现智能检索:n8n + 向量数据库实战指南
格式化结果输出
<code class="javascript">const query = $('查询请求').first().json.body.query;const matches = $json.matches;// 格式化结果const results = matches.map(match => ({  content: match.metadata?.text || '',  score: match.score,  source: match.metadata?.source || 'unknown',  chunkIndex: match.metadata?.chunkIndex || 0,  uploadTime: match.metadata?.uploadTime || ''}));return [{  json: {    success: true,    query: query,    results: results,    total: results.length,    timestamp: new Date().toISOString()  }}];</code>

这个转换的核心目的是提取必要字段、统一命名、增加业务标记(success、timestamp)。content 字段存储的是文档的文本内容,score 是相似度得分(0-1之间),source 标识文档来源文件名。

返回最终结果

最后添加 Respond to Webhook 节点,响应格式选择 JSON,内容直接引用上一步的输出:

不写代码实现智能检索:n8n + 向量数据库实战指南
返回查询结果
<code class="json">{{ $json }}</code>

这样客户端会收到一个结构清晰的 JSON 响应,包含查询词、匹配结果列表、总数和时间戳。

验证效果

保存并激活工作流后,通过 curl 测试查询接口:

<code class="bash">curl -X POST https://your-n8n-domain.com/webhook/knowledge/query \  -H "Content-Type: application/json" \  -H "x-api-key: your-secret-api-key" \  -d '{    "query": "测试",    "top_k": 3  }'</code>

成功后会返回类似这样的响应:

<code class="json">{  "success": true,  "query": "测试",  "results": [    {      "content": "测试文档内容:这是一个简单的测试。",      "score": 0.668823719,      "source": "测试文档.txt",      "chunkIndex": 0,      "uploadTime": "2025-10-27T13:10:49.807Z"    }  ],  "total": 3,  "timestamp": "2025-11-03T14:14:14.248Z"}</code>
不写代码实现智能检索:n8n + 向量数据库实战指南
工作流执行成功

从 n8n 的执行记录可以看到,所有节点都成功执行,响应时间在可接受范围内。相似度得分 0.67 说明找到了较为相关的内容,如果得分低于 0.5 通常意味着查询与知识库内容关联不强。

总结

通过 n8n 搭建向量检索服务的过程相当直观,核心在于理解数据在各个节点间的流转和转换。Webhook 负责接收请求并控制响应时机,If 节点用于权限控制和流程分支,HTTP Request 节点调用外部服务,Code 节点则处理复杂的数据转换逻辑。这套流程不仅适用于知识库查询,稍作调整就能扩展到文档上传、批量检索、智能推荐等场景,关键是把握好每个环节的输入输出格式。

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
数据分析的方法
数据分析的方法

数据分析的方法有:对比分析法,分组分析法,预测分析法,漏斗分析法,AB测试分析法,象限分析法,公式拆解法,可行域分析法,二八分析法,假设性分析法。php中文网为大家带来了数据分析的相关知识、以及相关文章等内容。

2023.07.04

1522

6

数据分析方法有哪几种
数据分析方法有哪几种

数据分析方法有:1、描述性统计分析;2、探索性数据分析;3、假设检验;4、回归分析;5、聚类分析。本专题为大家提供数据分析方法的相关的文章、下载、课程内容,供大家免费下载体验。

2023.08.07

1990

5

网站建设功能有哪些
网站建设功能有哪些

网站建设功能包括信息发布、内容管理、用户管理、搜索引擎优化、网站安全、数据分析、网站推广、响应式设计、社交媒体整合和电子商务等功能。这些功能可以帮助网站管理员创建一个具有吸引力、可用性和商业价值的网站,实现网站的目标。

2023.10.16

5670

14

数据分析网站推荐
数据分析网站推荐

数据分析网站推荐:1、商业数据分析论坛;2、人大经济论坛-计量经济学与统计区;3、中国统计论坛;4、数据挖掘学习交流论坛;5、数据分析论坛;6、网站数据分析;7、数据分析;8、数据挖掘研究院;9、S-PLUS、R统计论坛。想了解更多数据分析的相关内容,可以阅读本专题下面的文章。

2024.03.13

2744

8

Python 数据分析处理
Python 数据分析处理

本专题聚焦 Python 在数据分析领域的应用,系统讲解 Pandas、NumPy 的数据清洗、处理、分析与统计方法,并结合数据可视化、销售分析、科研数据处理等实战案例,帮助学员掌握使用 Python 高效进行数据分析与决策支持的核心技能。

2025.09.08

3645

12

Python 数据分析与可视化
Python 数据分析与可视化

本专题聚焦 Python 在数据分析与可视化领域的核心应用,系统讲解数据清洗、数据统计、Pandas 数据操作、NumPy 数组处理、Matplotlib 与 Seaborn 可视化技巧等内容。通过实战案例(如销售数据分析、用户行为可视化、趋势图与热力图绘制),帮助学习者掌握 从原始数据到可视化报告的完整分析能力。

2025.10.14

5312

24

Python 数据分析与可视化合集
Python 数据分析与可视化合集

聚焦 Python 在数据分析领域的核心应用,讲解 NumPy 数组运算、Pandas 数据清洗与聚合统计、缺失值与异常值处理、数据透视表生成,以及使用 Matplotlib、Seaborn、Pyecharts 制作折线图、柱状图、热力图、地图等多种可视化图表,适合数据分析师和运营人员快速掌握用 Python 从原始数据中挖掘洞察的能力。

2026.04.08

196

25

Python数据分析与Pandas高级实战
Python数据分析与Pandas高级实战

本专题围绕 Python 数据分析展开,系统讲解 Pandas 的高级用法,包括数据清洗、透视表、时间序列分析以及多表合并与分组操作。通过实战案例,帮助开发者掌握高效处理与分析数据的方法,提高数据处理效率与分析能力。

2026.04.13

251

25

数据分析的方法
数据分析的方法

数据分析的方法有:对比分析法,分组分析法,预测分析法,漏斗分析法,AB测试分析法,象限分析法,公式拆解法,可行域分析法,二八分析法,假设性分析法。php中文网为大家带来了数据分析的相关知识、以及相关文章等内容。

2023.07.04

1522

6

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
WebStorm 官方调试文档
WebStorm 官方调试文档

共0课时 | 0人学习

React 教程
React 教程

共58课时 | 11.9万人学习

TypeScript 教程
TypeScript 教程

共19课时 | 6.5万人学习