必须在提示词开头强制规定分步输出格式,每步后用【输出】单独一行标注具体结果,包括字段名、类型、样本值或行数,并用硬性限制堵住空输出、模糊表述等漏洞。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

要让DeepSeek在数据处理流程中清晰说明每一步的输出内容,必须在提示词里强制它按步骤拆解、逐层标注输出结果,不能笼统描述过程。直接写“请处理数据”会让模型跳过中间环节,只给最终答案。
明确要求分步输出格式
在提示词开头就写清楚结构指令:“请严格按以下四步执行,每步结束后用【输出】开头单独一行写出该步生成的具体内容(含字段名、数据类型、样本值或行数),不加解释。”
这一步必须前置,否则模型默认自由发挥。DeepSeek不会主动分步输出,必须用强约束句式锁定行为。
为每一步绑定输入来源和输出定义
方法一:用编号+箭头链明确依赖关系
第一步:读取原始CSV → 【输出】DataFrame,12列,4732行,首行为['user_id','event_time','action'],dtypes为{'user_id': 'int64', 'event_time': 'datetime64[ns]', 'action': 'object'}
第二步:过滤action为'click'或'purchase'的行 → 【输出】DataFrame,3列,2189行,无缺失值
第三步:按user_id聚合,统计click_count和purchase_count → 【输出】DataFrame,3列,1842行,索引为Int64Index,click_count均值=3.2,purchase_count最大值=7
方法二:用表格形式声明每步契约
│ 步骤 │ 输入 │ 输出要求 │
│------│------│-----------│
│清洗 │ 原始日志文本 │ 输出纯UTF-8字符串,每行格式为“[时间][用户ID][动作]”,时间转为ISO 8601,用户ID去重补零至8位 │
堵住模型省略中间结果的漏洞
在最后追加一句硬性限制:“若某步输出为空,必须写【输出】[];若输出为单个数值,必须写【输出】42.0(带小数点表明float类型);禁止用‘得到结果’‘完成处理’等模糊表述替代实际输出。”
【这是最关键的一句】没有它,DeepSeek大概率把聚合后的count直接写成“共1842个用户”,而不是【输出】1842。










