如何利用 Gemini 自带的过滤等级防止输出敏感内容?实战设置教程

小枫君_3380

小枫君_3380

2026-04-16

555人浏览

原创

需显式配置gemini安全过滤机制:一、在generate_content中传入含六类harm_category的safety_settings字典;二、用harmcategory/harmblockthreshold枚举构建类型安全配置;三、在start_chat中全局设定策略;四、仅对必要类别设block_none,禁用全部将违反服务条款。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

如何利用 gemini 自带的过滤等级防止输出敏感内容?实战设置教程

如果您在使用 Gemini 生成内容时希望主动抑制敏感信息输出,需明确配置其内置的多类别安全过滤机制。Gemini 并不默认启用宽松策略,必须通过显式声明危害类别与对应阻断阈值来生效。以下是实现该目标的实战设置步骤:

一、显式传入完整 safety_settings 字典(SDK 级配置)

此方法适用于单次请求,直接在 generate_content 调用中注入过滤策略,避免依赖默认或空配置导致策略未加载。Gemini 将依据该字典对六类危害内容进行实时拦截。

1、确保已安装 google-generativeai >= 0.8.1,并完成 API 密钥配置。

2、初始化 GenerativeModel 实例时,不传入 safety_settings 参数;该参数须在 generate_content 方法中显式提供。

3、构造包含全部有效类别的字典,键为字符串形式的 HARM_CATEGORY_*,值为字符串阈值,例如:{"HARM_CATEGORY_HARASSMENT": "BLOCK_MEDIUM_AND_ABOVE", "HARM_CATEGORY_SEXUALLY_EXPLICIT": "BLOCK_ONLY_HIGH", "HARM_CATEGORY_HATE_SPEECH": "BLOCK_MEDIUM_AND_ABOVE", "HARM_CATEGORY_DANGEROUS_CONTENT": "BLOCK_MEDIUM_AND_ABOVE", "HARM_CATEGORY_MEDICAL": "BLOCK_ONLY_HIGH", "HARM_CATEGORY_VIOLENCE": "BLOCK_MEDIUM_AND_ABOVE"}。

4、将该字典作为 safety_settings 参数传入 model.generate_content(),不可省略任一类别,否则缺失项将回退至默认高敏感策略。

二、使用 HarmCategory 与 HarmBlockThreshold 枚举构建类型安全配置

该方式规避字符串硬编码风险,提升代码可维护性与 IDE 自动补全支持,尤其适合长期演进项目或团队协作场景。

1、从 google.generativeai.types 导入 HarmCategory 和 HarmBlockThreshold。

2、检查当前 SDK 支持的完整类别列表:print([c.name for c in HarmCategory]),确认 HARM_CATEGORY_MEDICAL 等扩展类别存在。

3、构建字典,键使用 HarmCategory.HARM_CATEGORY_SEXUALLY_EXPLICIT,值使用 HarmBlockThreshold.BLOCK_LOW_AND_ABOVE。

4、将该字典赋值给 safety_settings 参数并调用 generate_content;若出现 ValueError,说明所用枚举值在当前版本中已被弃用或拼写不匹配。

Baoyu Danger Gemini Web
Baoyu Danger Gemini Web

通过逆向工程的Gemini网页API生成图像和文本。支持文本生成、提示词图像生成以及用于视觉输入的参考图像等。

下载

三、在 ChatSession 中全局启用一致过滤强度

当需在整个对话生命周期内维持统一内容边界时,可在会话初始化阶段一次性设定安全策略,后续所有 send_message 均继承该配置,无需重复声明。

1、调用 model.start_chat() 方法,并传入 safety_settings 参数,结构与 generate_content 所需完全一致。

2、验证是否生效:在会话中连续发送含潜在骚扰倾向的语句(如“如何嘲讽同事”),观察是否稳定返回 SAFETY_BLOCKED 错误而非生成响应。

3、注意:临时聊天模式(Incognito mode)下该配置仍有效,但不会保存历史记录或影响其他会话的安全上下文。

4、若会话中途需切换策略,必须新建 ChatSession,现有实例无法动态更新 safety_settings。

四、禁用特定类别以保留业务必要表达

某些合规场景需允许中低风险表述存在(如医疗咨询中提及“癌症治疗方案”),此时应针对性放开对应类别,而非整体关闭过滤。

1、识别业务必需但易被拦截的类别,例如 HARM_CATEGORY_MEDICAL 在健康问答中常触发误拦。

2、将该类别阈值设为 "BLOCK_NONE",其余类别保持原有严格等级,例如:{"HARM_CATEGORY_MEDICAL": "BLOCK_NONE", "HARM_CATEGORY_HARASSMENT": "BLOCK_MEDIUM_AND_ABOVE"}。

3、测试对比:使用相同 prompt 分别在启用与禁用 HARM_CATEGORY_MEDICAL 的配置下运行,确认仅该类拦截解除,其余风险仍受控。

4、严禁将全部类别设为 BLOCK_NONE,该操作将导致模型完全失去政策合规约束,违反 Google Cloud AI 服务条款。

相关文章

PHP速学视频免费教程(入门到精通)
PHP速学视频免费教程(入门到精通)

PHP怎么学习?PHP怎么入门?PHP在哪学?PHP怎么学才快?不用担心,这里为大家提供了PHP速学教程(入门到精通),有需要的小伙伴保存下载就能学习啦!

下载

相关标签:

gemini

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
Gemini网页版零基础入门:5分钟上手Gemini聊天指南
Gemini网页版零基础入门:5分钟上手Gemini聊天指南

本专题专为零基础用户打造,5分钟快速掌握Gemini网页版核心用法。从账号登录到界面布局,详解如何发起对话、优化提示词及利用多模态功能。通过实战案例,教你高效获取信息、创作内容与分析数据。无论学习还是工作,轻松开启AI辅助新时代,让Gemini成为你的得力智能助手。

2026.03.18

17217

10

如何写出高效Gemini提示:Chain of Thought实用教程
如何写出高效Gemini提示:Chain of Thought实用教程

本专题详解如何利用“思维链”(Chain of Thought)技巧激发 Gemini 模型的深度推理能力。通过引导模型将复杂问题拆解为逐步推导的逻辑链条,显著提升其在数学计算、代码生成及逻辑分析任务中的准确率。文章提供实用提示模板与对比案例,助您掌握结构化提问方法,从简单指令升级为高效交互,轻松获取更精准、可解释的智能回答。

2026.03.23

57

10

Gemini多模态实战:图片PDF视频输入完整处理指南
Gemini多模态实战:图片PDF视频输入完整处理指南

本指南全面解析 Gemini 多模态实战,涵盖图片、PDF 及视频的高效处理流程。从上传技巧到提示词设计,教您如何提取文档关键信息、分析图表数据及解读视频内容。通过真实案例演示,助您掌握跨模态交互核心技能,轻松构建智能文档分析与多媒体理解应用,释放 AI 潜能。

2026.03.23

77

10

Gemini提示工程进阶:Few-shot与角色扮演优化方法
Gemini提示工程进阶:Few-shot与角色扮演优化方法

本进阶指南深入解析 Few-shot 学习与角色扮演在 Gemini 提示工程中的核心应用。通过精选示例引导模型模仿特定风格,结合角色设定规范输出语气与逻辑,显著提升复杂任务的处理精度。文章提供实用模板与调优策略,助您打造个性化 AI 助手,实现从通用回答到专业级交互的质的飞跃。

2026.03.23

96

10

Google AI Studio使用教程:从模板到自定义Prompt实战
Google AI Studio使用教程:从模板到自定义Prompt实战

本教程手把手教您掌握 Google AI Studio,从快速调用官方模板到深度自定义 Prompt 实战。内容涵盖界面导航、参数调优及版本管理,助您灵活构建专属 AI 应用。通过真实案例演示,让您轻松实现从创意构思到原型部署的全流程,高效释放 Gemini 模型潜能,打造智能化解决方案。

2026.03.23

101

12

Gemini API快速上手:Python调用generateContent完整指南
Gemini API快速上手:Python调用generateContent完整指南

本指南详解如何使用 Python 快速调用 Gemini API 的 generateContent 方法。从环境配置、密钥管理到核心代码实现,逐步演示文本生成、多模态输入及流式响应处理。包含完整示例与错误排查技巧,助开发者轻松集成 Gemini 强大能力,构建高效智能应用,开启 AI 开发新篇章。

2026.03.23

110

11

如何实现Gemini函数调用:Tool Use与外部工具集成教程
如何实现Gemini函数调用:Tool Use与外部工具集成教程

本教程深入解析 Gemini 函数调用机制,详解 Tool Use 配置与外部工具集成流程。从定义函数架构到处理动态参数,手把手教您连接数据库、搜索 API 及自定义服务。通过实战案例,展示如何让 AI 自主规划并执行复杂任务,突破纯文本限制,构建具备真实行动力的智能代理系统。

2026.03.23

185

11

Gemini结构化输出JSON模式:API稳定提取数据实战
Gemini结构化输出JSON模式:API稳定提取数据实战

本实战指南详解如何利用 Gemini API 的 JSON 模式实现结构化数据提取。通过配置响应格式约束,确保模型输出严格符合预定义 Schema,彻底解决解析错误难题。内容涵盖字段定义、类型校验及异常处理,助您在信息抽取、数据清洗等场景中构建高稳定性管道,轻松将非结构化文本转化为可靠的应用数据。

2026.03.23

111

13

Gemini上下文缓存功能:如何大幅降低长对话成本指南
Gemini上下文缓存功能:如何大幅降低长对话成本指南

本指南深入解析 Gemini 上下文缓存(Context Caching)功能,助您大幅降低长对话与大规模文档处理成本。通过复用高频输入的嵌入表示,避免重复计算令牌,显著减少延迟与费用。内容涵盖缓存创建、管理及最佳实践,特别适合多轮对话、知识库问答等场景,让您在保持高性能的同时,实现极具性价比的 AI 应用部署。

2026.03.23

55

8

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
Gemini Notebook常见问题解答
Gemini Notebook常见问题解答

共0课时 | 0人学习

Gemini Notebook官方手册
Gemini Notebook官方手册

共0课时 | 0人学习