需先预处理pdf为纯净txt:剥离扫描图层、多栏排版及页眉水印,提取可选文字并清洗页码、空行与附件内容,严格保留加粗标题和编号需求条目作为逻辑锚点。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要在三天内理清一份86页、含12个模块、嵌套5级标题的项目需求文档,并输出可交付的结构化需求清单,但手动通读效率低、易遗漏交叉约束条件。Kimi能直接解析原始PDF并识别隐含逻辑关系,前提是避开格式陷阱与指令模糊区。
上传前预处理文档
原始PDF若含扫描件图层、多栏排版或页眉水印,Kimi会将乱码当正文解析,导致后续所有分析基于错误文本。必须先剥离干扰项再上传。
用WPS打开需求文档→点击“PDF工具”→选择“提取文字”→勾选“仅提取可选文字区域”,关闭OCR选项→保存为UTF-8编码的TXT文件。
用记事本打开该TXT→按Ctrl+H打开替换框→第一次替换:查找“第\d+页”→替换为空;第二次替换:查找“[\r\n]{3,}”→替换为“\r\n\r\n”(两个换行符)→删除所有以“附件”“附录”开头的段落(除非需求明确要求分析附件)。
【关键前提】必须保留原文中的加粗标题行和带编号的需求条目(如“3.2.1 用户登录需支持短信验证码”),这些是Kimi识别需求层级的核心锚点。
分块提交并注入逻辑锚点
整份文档超12万字,直接上传会导致模型对跨模块依赖关系识别失效。需按业务流切分,每块注入上下文衔接指令。
方法一:按系统模块切分
将TXT按“1. 总体架构”“2. 用户管理”“3. 权限控制”等一级标题拆为独立文件,每份控制在1.8万字符内;上传第一个模块后,输入:“请记住【用户管理模块】全部内容,后续将提供【权限控制模块】,需分析两模块间的数据权限映射关系。”
方法二:按需求类型切分
用正则表达式提取所有含“应”“须”“必须”“不得”的句子(即强制性需求),另存为“刚性需求.txt”;提取含“建议”“可选”“考虑”的句子存为“弹性需求.txt”;上传时指令为:“仅分析以下刚性需求文本,标注每条对应的原始章节号(如P12-3表示第12页第3段)。”
使用 Moonshot Kimi API 的 $web_search 内置工具进行联网搜索。当需要进行网络搜索获取实时信息时使用,支持中文和英文搜索查询。需要配置 MOONSHOT_API_KEY。
注意:切分时严禁在句子中间截断,尤其避免把“当A发生时,B须执行C”拆成两段——这会让Kimi丢失条件触发逻辑。
触发结构化需求抽取
泛泛而问“总结需求”会得到散文式描述。必须用动词锁定动作、用字段约束输出,才能生成可直接导入Jira的需求条目。
第一步:输入固定角色指令
“你是一名资深需求分析师,正在为敏捷开发团队准备Sprint Backlog。请严格按以下四字段输出,每条需求独占一行,不加序号:【功能模块】|【需求ID】|【验收条件】|【约束说明】”
第二步:粘贴预处理后的TXT全文(非上传文件)
第三步:追加指令限定范围
“仅输出涉及‘第三方支付对接’‘数据加密传输’‘审计日志留存’三个关键词的需求条目,其他内容全部忽略。”
【不可逆操作】发送后勿点击“重新生成”,否则已加载的上下文会被清空,需从头上传。
校验关键交叉约束
需求文档中90%的缺陷隐藏在模块交界处,例如“用户管理模块要求手机号唯一”与“客服模块允许同一号码绑定多个工号”形成冲突。Kimi能自动发现这类矛盾,但需主动触发验证机制。
① 将上一步生成的结构化需求清单复制到新对话窗口
② 输入指令:“逐条检查以下需求条目,若某条与另一条存在逻辑冲突(如A要求唯一、B允许重复),则输出:【冲突ID】←→【冲突ID】|冲突类型(数据规则/流程顺序/权限覆盖)|原文依据(精确到段落编号)”
③ 粘贴全部需求条目,点击发送
④ 对返回的每组冲突,单独发起追问:“请定位【冲突ID】在原始文档中的完整上下文,包括前后两段内容”








