千问的embedding模型怎么用?文本向量化和语义搜索实现

老芳姑娘_7238

老芳姑娘_7238

2026-05-16

830人浏览

原创

需调用通义千问embedding模型实现文本向量化,支持五种路径:一、dashscope在线api;二、本地加载qwen3-embedding-4b;三、vllm部署restful服务;四、jupyter交互式推理;五、agentrun平台集成。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

千问的embedding模型怎么用?文本向量化和语义搜索实现

如果您希望将非结构化文本转化为可用于语义计算的数值表示,并支撑检索、聚类或RAG等任务,则需调用通义千问Embedding模型完成文本向量化。以下是多种可行的实现路径:

一、使用DashScope平台在线API调用

该方式无需本地部署模型,适用于快速验证与轻量级集成,依赖阿里云DashScope服务提供的标准化接口,兼容OpenAI格式,适合Python等主流语言开发环境。

1、访问DashScope控制台,开通服务并获取API Key。

2、在项目中安装openai Python SDK:pip install openai。

3、设置环境变量DASHSCOPE_API_KEY为您的密钥值。

4、初始化OpenAI客户端,指定base_url为DashScope兼容端点:https://dashscope.aliyuncs.com/compatible-mode/v1。

5、调用client.embeddings.create方法,传入文本列表与模型名(如text-embedding-v3或text-embedding-v4)。

二、本地加载Qwen3-Embedding-4B模型

该方式支持私有化部署与离线运行,适用于对数据安全要求高、需长上下文处理(最高32K token)或硬件资源可控的场景,模型可在消费级显卡(如RTX 3060,3GB显存)上运行。

1、通过Hugging Face Hub下载模型权重:snapshot_download(repo_id="Qwen/Qwen3-Embedding-4B", local_dir="./qwen3-embedding-4b")。

2、安装transformers与torch库:pip install transformers torch。

3、使用AutoTokenizer与AutoModelForSequenceClassification加载分词器与模型。

4、对输入文本进行tokenize,注意启用return_tensors="pt"与truncation=True, padding=True。

5、执行前向传播,取最后一层隐藏状态的[CLS]位置输出,或采用池化策略(如mean pooling)生成2560维向量。

三、基于vLLM启动RESTful服务

该方式面向生产环境,提供高并发、低延迟的HTTP接口,支持批量向量化请求,适用于需嵌入至Web系统或微服务架构的语义搜索后端。

1、拉取预构建Docker镜像:docker pull qwen/embedding-4b-vllm:latest。

One API key for 70+ AI models. Route to GPT, Claude, Gemini, Qwen, Deepseek, Grok and more
One API key for 70+ AI models. Route to GPT, Claude, Gemini, Qwen, Deepseek, Grok and more

统一LLM网关 - 一个API对接70+AI模型,使用单一API密钥即可调用GPT、Claude、Gemini、Qwen、Deepseek、Grok等主流模型。

下载

2、运行容器并映射端口:docker run -d -p 8000:8000 qwen/embedding-4b-vllm:latest。

3、向http://localhost:8000/v1/embeddings发送POST请求,JSON体包含model、input(字符串或数组)、dimensions(可选,默认2560)及instruction(如“检索”)。

4、响应中data字段返回嵌入向量列表,每个元素含index与embedding字段。

四、在Jupyter中直接运行推理示例

该方式适合教学演示、原型验证与交互式调试,利用notebook环境即时查看向量结构与相似度计算结果,便于理解语义空间分布特性。

1、在Jupyter中安装所需依赖:!pip install transformers torch scikit-learn numpy。

2、导入Qwen3-Embedding-4B模型与分词器,设置device为cuda(如有)或cpu。

3、定义encode函数:对单条文本tokenize后送入模型,提取last_hidden_state,执行torch.mean(..., dim=1)获得句向量。

4、对两段测试文本分别编码,使用cosine_similarity计算余弦相似度,验证语义相近文本得分更高。

5、将多条文本向量堆叠为矩阵,调用sklearn的NearestNeighbors拟合索引,实现简易语义搜索闭环。

五、接入agentrun向量模型管理系统

该方式适用于已使用agentrun平台构建RAG或智能体系统的用户,通过可视化界面统一纳管多个Embedding模型,按知识库场景动态切换,降低运维复杂度。

1、登录agentrun控制台,在顶部菜单选择模型管理 → 向量模型。

2、点击添加模型,选择服务提供商为通义千问。

3、填写模型名称(如cn-rag-embedding)与描述,保存配置。

4、在知识库模块创建新知识库时,在向量化模型下拉项中选择刚添加的模型实例。

5、上传文档后,系统自动调用该模型完成切片与向量化,写入关联向量数据库供后续检索调用。

相关专题

更多
WorkBuddy核心功能与实操模式
WorkBuddy核心功能与实操模式

深入探索WorkBuddy的强大功能。本专题包含智能问答、文档处理、会议纪要生成、日程管理、任务协作等核心模块的操作指南与最佳实践。通过图文并茂的教程,助您快速上手,最大化发挥WorkBuddy的办公效能。

2026.04.09

582

19

数据分析的方法
数据分析的方法

数据分析的方法有:对比分析法,分组分析法,预测分析法,漏斗分析法,AB测试分析法,象限分析法,公式拆解法,可行域分析法,二八分析法,假设性分析法。php中文网为大家带来了数据分析的相关知识、以及相关文章等内容。

2023.07.04

1682

6

数据分析方法有哪几种
数据分析方法有哪几种

数据分析方法有:1、描述性统计分析;2、探索性数据分析;3、假设检验;4、回归分析;5、聚类分析。本专题为大家提供数据分析方法的相关的文章、下载、课程内容,供大家免费下载体验。

2023.08.07

2270

5

网站建设功能有哪些
网站建设功能有哪些

网站建设功能包括信息发布、内容管理、用户管理、搜索引擎优化、网站安全、数据分析、网站推广、响应式设计、社交媒体整合和电子商务等功能。这些功能可以帮助网站管理员创建一个具有吸引力、可用性和商业价值的网站,实现网站的目标。

2023.10.16

6350

14

数据分析网站推荐
数据分析网站推荐

数据分析网站推荐:1、商业数据分析论坛;2、人大经济论坛-计量经济学与统计区;3、中国统计论坛;4、数据挖掘学习交流论坛;5、数据分析论坛;6、网站数据分析;7、数据分析;8、数据挖掘研究院;9、S-PLUS、R统计论坛。想了解更多数据分析的相关内容,可以阅读本专题下面的文章。

2024.03.13

2904

8

Python 数据分析处理
Python 数据分析处理

本专题聚焦 Python 在数据分析领域的应用,系统讲解 Pandas、NumPy 的数据清洗、处理、分析与统计方法,并结合数据可视化、销售分析、科研数据处理等实战案例,帮助学员掌握使用 Python 高效进行数据分析与决策支持的核心技能。

2025.09.08

4105

12

Python 数据分析与可视化
Python 数据分析与可视化

本专题聚焦 Python 在数据分析与可视化领域的核心应用,系统讲解数据清洗、数据统计、Pandas 数据操作、NumPy 数组处理、Matplotlib 与 Seaborn 可视化技巧等内容。通过实战案例(如销售数据分析、用户行为可视化、趋势图与热力图绘制),帮助学习者掌握 从原始数据到可视化报告的完整分析能力。

2025.10.14

6092

24

Python 数据分析与可视化合集
Python 数据分析与可视化合集

聚焦 Python 在数据分析领域的核心应用,讲解 NumPy 数组运算、Pandas 数据清洗与聚合统计、缺失值与异常值处理、数据透视表生成,以及使用 Matplotlib、Seaborn、Pyecharts 制作折线图、柱状图、热力图、地图等多种可视化图表,适合数据分析师和运营人员快速掌握用 Python 从原始数据中挖掘洞察的能力。

2026.04.08

276

25

Python数据分析与Pandas高级实战
Python数据分析与Pandas高级实战

本专题围绕 Python 数据分析展开,系统讲解 Pandas 的高级用法,包括数据清洗、透视表、时间序列分析以及多表合并与分组操作。通过实战案例,帮助开发者掌握高效处理与分析数据的方法,提高数据处理效率与分析能力。

2026.04.13

431

25

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
通义千问基本用法
通义千问基本用法

共1课时 | 228人学习

通义千问的提示词工程
通义千问的提示词工程

共1课时 | 264人学习