天工ai需经ocr预处理、文档模式启用与结构锚定三步联动,才能精准提取pdf中作者核心观点、论证逻辑与可复用结论;扫描图像型pdf必须先ocr,上传须禁用拖拽并确认目录树生成,方可支持分章节指令提取或多文档交叉比对。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要从上百页PDF中快速抓取作者的核心观点、论证逻辑与可复用结论,而不是逐字通读。天工AI能完整处理50MB以内PDF,但直接提问“总结这本书”会返回泛泛而谈的概述,必须配合文档模式启用、结构锚定与指令约束三步联动,才能稳定输出可直接写进读书笔记的观点条目。
确认PDF具备可读文本层
打开PDF,用鼠标尝试选中任意一段正文文字。若无法高亮复制,说明是扫描图像型PDF,天工AI将无法提取任何语义内容。
此时必须先做OCR:在WPS中打开该PDF→点击“PDF工具→OCR识别→选择语言为中文→开始识别”,完成后另存为新PDF。Adobe Acrobat用户请使用“工具→扫描和OCR→识别文本”。【未做OCR就上传会导致天工AI返回‘文档内容为空’或仅输出页码编号】
网页端上传并启用文档模式
访问tiangong.cn,登录后点击左侧导航栏【AI文档】→【新建项目】→选择【文档模式】。
点击“+ 添加文件”,从本地选取已OCR处理好的PDF——不要用拖拽方式上传,拖拽会跳过文档结构解析引擎。
等待右上角出现“文档已解析完成”提示,且左侧自动展开带层级的目录树(含章、节、小节),表示标题结构、列表、段落已被识别。若30秒内无此提示,请检查PDF属性→安全性→是否勾选“禁止复制”,该类加密文件必须联系出版方获取授权版本。
分章节锚定+结构化指令提取观点
方法一:按自然章节截取(推荐用于学术专著)
① 在左侧目录树中展开,找到一级标题如“第四章 群体决策的认知偏差”;
② 点击该标题,天工AI自动定位到对应页码范围,并在右侧预览区高亮显示该章节全部文本;
③ 在对话框输入:“请仅基于本章节内容,逐条列出作者提出的3个核心观点,每条不超过18字,不加解释,不引用原文以外信息。”
④ 发送后若混入其他章节内容,立即追加:“忽略所有非本章节页码的文本,重新输出。”
方法二:关键词驱动定位(适用于结构松散的实践类书籍)
第一步:在对话框输入:“请扫描全文,找出所有含‘本质上’‘关键在于’‘根本原因是’‘必须满足’的句子,按出现顺序列出。”
第二步:复制返回结果,在本地文本编辑器中人工剔除设问句、举例句、过渡句,只保留承载独立判断的陈述句。
多文档交叉比对提取关键数据
打开天工AI官网(tongyi.kunlun.com),登录后点击顶部导航栏【文档智能体】→【新建任务】。
在弹窗中选择「多文档深度汇总」模式,点击「添加文件」按钮,一次性选中全部PDF(支持最多10份,单份不超过20MB);【必须全部选中后点击一次“确定”,不可逐份上传,否则系统无法建立文档间语义关联】。
文件上传完成后,页面自动显示文档列表及基础元信息(页数、大小、识别状态),等待右上角绿色对勾图标出现,表示全部解析就绪。
在指令输入框中输入:“请横向对比这5份报告中‘2023–2025年华东地区新能源汽车销量’数据,提取原始数值、单位、来源页码,并标注各报告对该数据的解读倾向(乐观/中性/谨慎)。”
点击「运行分析」,系统开始跨文档联合推理,耗时约40–90秒,取决于文档总页数和指令复杂度。









