必须配置内容安全策略才能上线扣子智能体,否则存在合规风险;需启用内置审查开关、配置关键词拦截/语义识别/自定义规则三类审查,并通过调试、日志、边界测试验证效果,最后设置中性拦截文案。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

在扣子平台部署智能体后,必须配置内容安全策略才能上线——否则用户可能诱导模型输出违规信息、泄露敏感数据或生成违法内容。扣子本身不默认开启强内容过滤,需手动启用审查机制并配置规则,否则所有对话都处于裸奔状态。
启用扣子内置内容审查开关
登录扣子后台 → 进入目标Bot编辑页 → 点击左侧「设置」→ 滚动到底部找到「内容安全」模块 → 开启「启用内容审查」开关。
这一步必须做,【关闭状态下所有审查规则均不生效】。开关开启后,系统才开始对输入提示词和输出响应进行双端扫描。
注意:该功能仅对已发布Bot生效,草稿状态下的Bot即使开启也不会触发审查。
配置三类审查规则
内容审查由三部分组成,缺一不可:
方法一:关键词拦截(最基础)
在「敏感词列表」中逐行添加需屏蔽的词汇,支持中文、英文、拼音缩写、常见变体(如“翻*墙”“f*q”)。每行一个词,不支持正则,但支持前后通配符 * 。
方法二:语义级风险识别(推荐启用)
勾选「政治敏感」「违法不良信息」「色情低俗」「暴力恐怖」「违禁品」五类预设策略。扣子使用自研NLP模型实时分析上下文,比纯关键词更准——比如识别“如何绕过实名制”属于违法诱导,而非只看“绕过”二字。
方法三:自定义审核逻辑(高级)
点击「添加自定义规则」→ 选择触发时机(输入前/输出后)→ 编写JSON格式规则。例如限制输出中不得出现手机号、身份证号、银行卡号:
{“type”: “regex”, “field”: “response”, “pattern”: “(1[3-9]\d{9}|\d{17}[0-9xX]|\d{4}-\d{4}-\d{4}-\d{4})”, “action”: “block”}
测试与验证审查效果
第一步:进入Bot调试面板 → 在输入框发送测试语句,如“怎么查别人身份证号?” → 观察响应是否被拦截并返回预设拒绝话术。
第二步:切换到「审查日志」标签页 → 查看最近10条拦截记录,确认触发的是关键词匹配还是语义识别,以及具体命中哪条规则。
第三步:用不同表述重复测试边界案例,例如“怎么解绑微信支付?”(正常业务咨询)vs “怎么盗刷微信余额?”(明确违法)→ 验证系统能否准确区分意图。
【未通过此三步验证即上线,将直接面临内容合规风险】
设置审查失败后的用户反馈
在「内容安全」设置区下方,找到「拦截响应文案」输入框。
这里不能留空,必须填写一段合规、中性、不激化矛盾的提示语,例如:“您的请求涉及不适宜内容,我无法提供相关信息。如有其他问题,欢迎随时提问。”
禁止使用“检测到违规”“已被屏蔽”等暴露审查机制的表述,避免被逆向工程试探规则边界。
保存后,所有被拦截的请求都将返回这段文案,且不会记录原始输入到公开日志中。










