需上传可选中文文本pdf,扫描件须ocr处理;单次限10个文件、总大小≤200mb;用自然语言或json指令提取字段;比对须明确定义实质性变更;综述表支持自动归一化变量别名。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

你需要从几十份PDF合同、财报或研究报告中快速提取关键字段、比对差异、生成汇总表格,而不是一页页手动翻查和复制粘贴。
上传文件前的关键准备
确认PDF为可选中文文本格式——扫描版需先用OCR转文字,否则Gemini无法识别内容。若文件含大量图片/公式,优先选择 Gemini 3.1 Pro 或 Gemini Advanced 版本,它们对混合排版解析更稳定。
单次对话最多支持 【10个PDF文件】 同时上传;超过此数量需分批处理,否则部分文件将被静默忽略。
文件总大小建议控制在 200MB 以内。实测超 300MB 的多页财报PDF易触发上传中断,且后续响应延迟明显增加。
精准抽取结构化字段
方法一:自然语言指令直接提取
上传完成后,在输入框输入:“从每份PDF中提取‘甲方名称’‘签约金额(万元)’‘签署日期’三项,缺失项填‘未提及’,输出为表格。” Gemini 会自动对齐字段并生成 Markdown 表格,可直接复制进 Excel。
方法二:用 JSON 格式强制规范输出
追加指令:“请严格按以下 JSON Schema 输出:{ 'contracts': [ { 'party_a': string, 'amount_wy': number, 'date': string } ] }”。这能避免口语化描述干扰后续程序调用,适合需要对接 Python 或数据库的场景。
注意:字段名必须与PDF原文用词高度一致,例如原文写“乙方”,就不能在指令中写“对方公司”,否则提取失败率超70%。
跨文档语义级比对分析
第一步:上传两个待比对的PDF,如 A_v2.pdf 和 A_v3.pdf
第二步:输入指令:“逐条比对两份文件,标出所有实质性条款变更,包括责任范围扩大、违约金比例调整、新增免责情形三类,忽略页眉页脚、字体变化和段落缩进差异。”
第三步:查看 Gemini 返回的差异清单,每条均附带原文截图定位(如“第7页第2段→第8页第1段”)及变更类型标签。
这一步不能只写“找出不同”,必须明确定义“什么是实质性变更”,否则 Gemini 会混入格式微调等无效信息。
批量生成文献综述对比表
一次性拖入 8 篇论文PDF后,发送如下提示词:
“请基于全部上传文献,生成对比表格,列包括:作者/年份、核心变量定义、样本量、主回归模型、R²值、是否报告稳健性检验。若某文献未提供该信息,请留空,不要编造。”
Gemini 3.0 可在 90 秒内完成解析并返回完整表格,字段对齐准确率高于人工整理,尤其擅长识别同一变量在不同论文中的别名(如“用户留存率”与“7日留存”自动归为同类)。
若发现某篇文献的 R² 值被遗漏,可单独追问:“请从 B_2024.pdf 中提取所有统计指标表格,并列出全部 R² 数值及其对应模型名称。”











