应关闭全局敏感词扫描并配置白名单规则:先在【安全与合规】→【内容审核设置】中关闭文档自动扫描及实时标注;再通过高级规则配置,按模型标识符(如x-model-source)设置跳过检测;最后可替换为轻量级白名单词库或调用/v1/generate/raw直通接口。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如果您在使用WorkBuddy自定义模型时,发现正常业务术语或行业表达被误判为敏感词并触发拦截,则可能是由于内容安全审核策略未适配模型语义特性,导致内置规则过度泛化匹配。以下是调整内容安全审核策略的具体操作步骤:
一、关闭全局敏感词实时扫描开关
该操作适用于需快速验证是否为策略引擎引发拦截的排查场景。关闭后,系统将跳过文档解析阶段的逐句比对流程,避免对自定义模型输出施加统一词表约束,从而排除基础策略干扰。
1、登录WorkBuddy管理后台,进入【安全与合规】菜单。
2、点击【内容审核设置】子选项卡。
3、在“文档自动扫描”区域,将开关状态由“开启”切换为关闭。
4、取消勾选“启用敏感词实时标注”复选框。
5、点击右上角保存配置按钮使设置立即生效。
二、为自定义模型输出路径添加白名单规则
该方式通过指定模型调用上下文或响应头标识,使安全策略引擎识别出该流量来源为可信模型输出,从而绕过关键词匹配逻辑,保留原始语义完整性。
1、在【内容审核设置】页面点击“高级规则配置”展开面板。
2、点击新建上下文规则按钮。
3、在“触发条件”栏输入模型标识符,例如X-Model-Source: custom-legal-v2。
4、在“执行动作”栏选择跳过全部敏感词检测。
5、设置匹配模式为“请求头精确匹配”,点击提交规则完成部署。
三、替换默认敏感词库为轻量级白名单驱动模式
该方法将原有黑名单匹配机制改为仅允许预设白名单内的词汇通过,彻底规避误拦截风险,特别适合术语高度专业化且边界清晰的自定义模型场景。
1、准备UTF-8编码的CSV文件,首行为字段名:word,category(示例:破产重整,法律术语;要式合同,法律术语)。
2、返回【内容审核设置】页面,下滑至“自定义词库管理”模块。
使用 draw.io(.drawio 格式)和 SVG 生成兼容 Microsoft Visio 的架构图。当用户需要以下任一场景时触发: - 用于 Visio 或技术文档的架构/系统/网络图 - 带连接标注的分层控制系统图 - 将 draw.io XML 转换为稳定、可嵌入的 SVG - 修复 Visio 或 draw.io 无法打开的故障排查类图表 - 任何需专业级布局且文本可编辑的图表
3、点击“清空当前词库”按钮,确认清除全部内置与历史导入词条。
4、点击选择文件按钮,上传已准备好的白名单CSV文件。
5、点击批量导入,导入完成后,页面显示新增词条数量,此时仅白名单内术语可被系统识别为合法输出。
四、禁用上下文过滤中的严格模式匹配
该操作可降低因前后字符约束或词性组合条件引发的误判概率,尤其适用于自定义模型生成文本中存在多义词嵌套、缩写高频或术语倒装等非标准表达结构的情况。
1、在【内容审核设置】中点击“高级规则配置”展开面板。
2、定位已启用的上下文规则条目,点击右侧“编辑”按钮。
3、将“匹配强度”由“严格模式”更改为宽松模式。
4、在“排除条件”栏补充添加模型典型输出前缀,例如【AI生成】、【模型输出】。
5、点击提交规则完成更新。
五、临时切换至API直通通道绕过审核层
该方式通过调用底层免审接口端点,使自定义模型输出直接进入展示层,不经过任何中间安全策略模块,适用于紧急交付、灰度验证或A/B测试等短周期需求。
1、构造POST请求,URL为/v1/generate/raw,Header中设置Authorization: Bearer
2、Request Body中仅包含model_id与prompt字段,不携带任何content_moderation相关参数。
3、收到HTTP 200响应后,检查response字段内容是否完整呈现原始模型输出。
4、若成功,可在生产调用链中为该模型专属路由配置反向代理规则,指向/v1/generate/raw端点。
5、执行curl命令验证连通性:curl -X POST https://api.workbuddy.cn/v1/generate/raw -H "Authorization: Bearer xxx" -d '{"model_id":"custom-medical-v3","prompt":"请解释ECMO的工作原理"}'。









