kimi可将pdf/word/网页一键转为规范markdown:保留h1-h3标题、统一列表与代码块格式、修复ocr错行、跳过乱码段落,并精细处理加粗/斜体/高亮/批注等富文本元素。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

把Kimi里打开的长文档(比如PDF、Word、网页)一键转成结构清晰、格式规范、可直接用于笔记或博客发布的Markdown文件,需要精准控制输出格式和内容取舍。
基础提示词模板
直接复制粘贴到Kimi对话框中使用:
请将以下文档内容转换为标准Markdown格式,要求:保留原始标题层级(H1-H3),正文段落不缩进,列表用短横线(-)或数字序号,代码块用三个反引号包裹并标注语言,表格保持对齐,图片保留原始描述但替换为标准Markdown语法:。去除页眉页脚、页码、水印、重复分隔线,跳过扫描件识别失败的乱码段落。
针对PDF扫描件的强化指令
扫描版PDF常出现文字错位、段落断裂、公式识别混乱,必须针对性约束:
你正在处理的是OCR识别后的PDF文本,可能存在换行错乱和段首空格残留。请先合并被错误折行的句子——同一自然段内连续出现的“句末标点+换行+首字母大写”视为断句错误,需连成一句;删除所有段首2个及以上空格;数学公式若无法还原为LaTeX,统一替换为【公式】占位符,不尝试猜测内容。
方法一:先让Kimi重排版再转码
上传PDF后,先输入:“请对当前文档执行逻辑段落重组:识别语义完整句子,合并被换行切断的长句,修复因OCR导致的段落碎片化。完成后,再按标准Markdown规则输出。”
方法二:跳过不可靠区域
遇到连续5行以上含大量乱码(如“ ”、“□□□”)、或单行超过80字符且无标点的,整段跳过,不强行转译。【跳过比硬凑更可靠,否则会污染后续Markdown渲染】
保留重点格式的精细控制
当原文有加粗、斜体、高亮色块、批注等富文本元素时,不能简单丢弃:
第一步:将原文中字体加粗部分转换为**双星号**,斜体转为*单星号*,下划线转为HTML标签(Markdown原生不支持,但Obsidian和Typora能渲染);
第二步:原文中黄色高亮背景的文字,统一改为==双等号包围==(支持MarkFlow、Obsidian的Highlight语法);
第三步:审阅批注(如“[编辑:此处需补充数据]”),转为标准Markdown注释格式:,确保不显示在最终渲染结果中;
第四步:表格若列数超过6列或存在跨行单元格,改用代码块包裹原始表格文本,并在上方标注“”。









