必须根据文档类型、语言特征和业务场景选择合适的向量模型,如中文为主选bge-m3,中英混排超30%选text-embedding-v3-small,并通过典型问法测试和召回日志验证效果。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要在扣子(Coze)知识库中获得准确的语义召回结果,必须根据文档类型、语言特征和业务场景选择合适的向量模型,模型选错会导致关键词能召回而语义相关的内容完全丢失。
确认知识库当前绑定的向量模型
进入 Bot 对应的知识库管理页 → 点击右上角「设置」图标 → 在弹出面板中查看「向量模型」字段显示的具体名称,如 【bge-m3】 或 【text-embedding-v3-small】。该字段不可编辑,仅反映当前生效模型;若此前未手动切换过,系统默认使用平台最新推荐模型,但旧 Bot 可能仍沿用 【bge-large-zh-v1.5】。
中文为主、含混合符号/短句的文档优先选 bge-m3
方法一:在知识库设置中点击「向量模型」右侧的「更换」按钮 → 从下拉列表中选择 【bge-m3】 → 点击「保存并重建索引」。
这一步会清空现有向量索引,全部重新计算,耗时取决于文档总 token 数,10 万字以内通常 2~5 分钟完成。重建期间知识库无法响应召回请求。
方法二:若知识库已上线且无法接受中断,先新建一个同结构知识库 → 绑定 bge-m3 → 上传相同文档集 → 等待索引就绪 → 将 Bot 的知识库引用切换至新库。注意:切换后原知识库的问答记录、热度统计等不迁移。
需跨语言检索或含大量英文术语时选 text-embedding-v3-small
第一步:确认文档中英文混排比例超过 30%,或存在较多缩写词(如 CRM、API、SLA)、代码标识符(如 useState、HTTP_404);
第二步:进入知识库设置 → 更换向量模型为 【text-embedding-v3-small】 → 勾选「启用多语言对齐优化」→ 保存并重建索引;
第三步:用含英文关键词的测试 query(如“如何处理 404 错误”)对比旧模型召回结果——若新模型返回更多含 error handling、not found response 的段落,说明切换有效。
注意:该模型对纯中文长文本的细粒度语义区分略弱于 bge-m3,不建议用于客服话术、政策条文等强中文语境场景。
验证召回质量的实操检测法
准备 5 条典型用户问法,覆盖模糊表达(如“那个上次说的退款流程”)、术语替换(如“履约”→“订单交付”)、错别字(如“优惠卷”→“优惠券”);
在知识库测试框中逐条输入 → 记录每条 query 返回的 top3 片段是否包含答案核心句;
若连续 3 条 query 的 top1 结果与问题无关,或答案被截断在片段末尾无法完整呈现,说明向量表征失效,需立即切回 bge-m3 并检查文档分块逻辑;
导出「召回日志」CSV,重点看「query embedding norm」值是否稳定在 0.97~1.03 区间——低于 0.95 表示 query 被异常压缩,高于 1.03 可能触发截断,此时应调整 query 预处理长度限制。











