longcat ai文档比对能力基于专用模块而非通用大模型,采用ocr+语义对齐+智能diff算法,支持pdf/docx/图片等格式及中英文,需配置模型并指定参考与比对文档,输出三色差异标注报告,供人工协同决策。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

LongCat AI 的文档比对能力不是靠“调用通用大模型”实现的,而是通过专用的 文档比对AI能力模块 提供结构化、高精度的差异识别。它不依赖提示词工程,而是基于OCR+语义对齐+智能diff算法,专为合同、协议、标书等正式文本设计。
一、确认支持的文档类型和格式
该能力原生支持以下输入:
- 文件格式:PDF(含扫描件)、DOC/DOCX、JPEG/JPG/PNG/BMP/TIFF(图片类需OCR)
- 语言范围:简体中文、English(页眉页脚/大小写/标点等忽略项仅限这两种)
- 长度与排版:支持不同页数、不同版式(如表格错位、页码偏移),启用“表格识别”可显著提升结构化内容比对准确率
二、创建并配置比对模型
登录平台后,进入「文档理解 → 文档比对」页面操作:
- 点击「新建模型」,填写名称,选择OCR引擎版本(推荐选最新稳定版)
- 开启关键选项:启用表格识别(防格式错位)、忽略页眉页脚(聚焦正文)、忽略大小写、忽略标点符号(可自定义标点列表)
- 保存后,模型即生效,无需训练或微调
三、执行比对任务
每次比对需指定两个角色:
- 参考文档:作为基准的原始/权威版本(如法务审定的电子合同)
- 比对文档:待检验的副本(如盖章后的纸质扫描件)
- 上传后系统自动完成OCR、段落对齐、语义级diff分析,生成带颜色标注的对比报告
- 差异分为三类:新增(绿色)、删除(红色)、修改(橙色),点击任意差异可直接跳转到原文位置
四、结果使用与人工协同
输出不是最终结论,而是辅助决策工具:
- 所有差异默认归入「待确认差异」,法务人员可逐条标记为“接受”“驳回”或“需复核”
- 系统会将已忽略项(如空格、换行、标点)单独归入「已忽略差异」面板,便于审计追溯
- 支持导出比对报告(含差异摘要+全文标注PDF),满足内控与合规存档要求











