参考样例是gemini处理数据流程提示词的关键启动器,必须包含真实字段名及对应动作,否则模型易误解清洗、分类、可视化等操作;有效样例需截取真实数据片段或对比正误版本,并嵌入角色声明、结构化样例区块与输出验证触发器。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

在用Gemini写数据处理流程提示词时,参考样例不是可选项,而是关键启动器——没有它,模型容易把“清洗”理解成删空行,把“分类”当成按首字母排序,把“可视化”直接输出一串matplotlib代码。
为什么必须放参考样例
Gemini对“数据处理流程”这个词没有天然共识。它见过10万份数据分析报告,但每份的颗粒度、角色视角、交付形态都不同:运营要的是渠道归因结论,财务要的是科目映射表,工程师要的是可复现的Python脚本。不给样例,等于让AI在雾中搭积木。
样例能锚定三件事:字段命名习惯(比如“订单金额”还是“order_amt”)、业务口径(“活跃用户”指近7日登录还是完成支付)、输出载体(是Excel分页结构,还是SQL建表语句+注释)。这些细节无法靠形容词描述清楚。
什么样的参考样例才有效
方法一:用真实片段截取,而非虚构
从你手头正在处理的Excel里,复制3~5行原始数据(含表头),再贴上你理想中的清洗后结果。例如:原始列名是“收货地址”,样例里写成“省|市|区|详细地址”,Gemini立刻明白你要地理字段拆解,而不是简单去重。
方法二:带错误示范的对比样例
先贴一段有问题的流程描述:“把数据整理一下,去掉重复值,生成图表。” → 再贴修正版:“① 用‘订单ID’去重,保留首次出现记录;② 按‘下单日期’转为YYYY-MM-DD格式;③ 分‘渠道’和‘销售额’两列,用柱状图展示各渠道周环比。” 这种对比能让Gemini识别出你真正在意的控制点:去重依据、日期标准化规则、图表维度约束。
【样例必须包含至少一个具体字段名和对应处理动作,否则Gemini会泛化为通用建议】
怎么把样例嵌进提示词里
第一步:在提示词开头声明角色与任务目标
“你是一名有3年电商数据分析经验的数据工程助理,负责为运营团队生成可落地的Excel清洗+分类+可视化流程。”
第二步:插入样例区块,用明确分隔符
【原始数据样例】
订单ID,下单日期,收货地址,商品类目,实付金额
ORD-2024-8891,2024/5/22,"北京市朝阳区建国路1号",女装,299.00
ORD-2024-8892,2024/5/22,"上海浦东新区张江路2号",数码,1299.00
【期望输出结构】
→ 清洗后字段:订单ID|下单日期(标准格式)|省|市|区|商品类目|实付金额
→ 分类逻辑:按“省”聚合,计算各省份订单数、平均实付金额
→ 可视化要求:用横向条形图展示TOP5省份订单数,Y轴为省份名,X轴为数量
第三步:绑定输出验证触发器
在末尾加一句:“请检查你的流程是否满足:① 所有字段名与样例中完全一致;② 分类聚合未引入新字段;③ 可视化指令可被Power BI或Excel直接执行。如有任一不满足,请重新生成。”











