需用显式语义标记规则切分混杂办公资料:①以“第”“一、”“本指南”开头的为【文档】;②含两行以上“|”对齐的为【表格】;③含“时间:”且紧接“主持人:”“参会人:”的为【会议纪要】,并按指定格式隔离输出。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要把一份混杂着文档说明、参数表格和会议纪要的原始办公资料,按内容类型自动切分成三类独立文件,避免人工翻查、复制、粘贴导致的信息错位或遗漏。
先识别原始资料中的三类内容边界
Perplexity无法直接“看到”段落类型,必须靠你用提示词显式锚定语义特征。不能只写“分开文档、表格、会议”,它会把所有带文字的块都归为“文档”。
第一步:通读原始资料,找出每类内容最硬的识别标记——【文档类通常以“第X章”“一、”“本指南适用”开头;表格类必含至少两行以上对齐的竖线分隔或“|”符号;会议纪要必定出现“时间:”“主持人:”“决议:”等字段】。
第二步:把这三类标记词整理成一组互斥关键词,例如:“章节|指南|说明”、“|”、“时间:|主持人:|参会人:”。
第三步:将原始资料全文粘贴进Perplexity输入框,紧接着输入提示词:“请严格按以下规则切分文本:① 凡以‘第’‘一、’‘本指南’开头的连续段落,归为【文档】;② 凡含至少两行且每行含‘|’符号的区块,归为【表格】;③ 凡含‘时间:’且后续紧接‘主持人:’‘参会人:’的连续段落,归为【会议纪要】。不合并、不补全、不改写,原样保留每类内容起止位置。”
导出三类内容到不同文件
方法一:用Markdown分隔符强制隔离
在提示词末尾追加:“输出格式为:【文档】\n---\n[原文内容]\n\n【表格】\n---\n[原文内容]\n\n【会议纪要】\n---\n[原文内容]。确保三个区块之间用两个换行+‘---’分隔。”
使用Perplexity API进行网络搜索的AI助手。当用户需要最新信息并附有来源引用、时事事实查询,或研究类答案时使用。当用户提及Perplexity或需要带有参考文献的最新信息时,默认使用此技能。
生成结果后,点击答案右上角“⋯”→“Copy as Markdown”,粘贴到VS Code中。用Ctrl+H搜索“【文档】\n---\n”,替换为“”,再把“”到下一个“---”之间的内容单独存为doc.md。
方法二:用浏览器开发者工具精准提取HTML区块
Chrome中打开Perplexity页面→右键任意一个“【表格】”标题→“检查”→在Elements面板中往上逐级找包含该标题及下方表格内容的
【注意:不要复制整个页面HTML,只复制对应区块,否则会混入导航栏和广告代码】
批量处理多份混合资料
步骤一:把10份原始资料分别重命名为“01_混合稿.txt”至“10_混合稿.txt”,放在同一文件夹。
步骤二:用Notepad++打开文件夹内任一txt→Ctrl+A全选→Ctrl+C复制→切换到Perplexity→粘贴→输入提示词:“请对以下10份资料分别执行切分:每份资料以‘文件名:’开头,后接内容。请为每份资料生成三行输出:第一行‘文档:[内容摘要前20字]…’;第二行‘表格:[首行字段名]’;第三行‘会议:[时间字段值]’。不跨文件合并,不省略字段。”
步骤三:复制全部输出→粘贴到Excel,用“数据→分列→按换行符”拆成三列→筛选出“表格:”列非空的行→复制对应行的原始全文→批量存为table_01.txt/table_02.txt…








