扣子平台仅支持百度ocr、腾讯ocr、阿里云ocr三款官方ocr插件,需通过插件市场添加并配置api密钥;调用时须指定“增值税发票”识别类型,输出json需经大模型清洗为飞书表格字段匹配格式。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

确认扣子平台支持的OCR插件类型
扣子(Coze)工作流节点中不内置通用OCR能力,必须通过「插件」方式引入第三方OCR服务,否则无法对上传的发票、收据等图片执行结构化识别。
目前官方插件市场明确支持的OCR类插件仅有:【百度OCR】、【腾讯OCR】、【阿里云OCR】三款,其他如Tesseract、Google Vision需自行封装API调用,不属于“引入插件”范畴。
选择时注意:百度OCR对中文票据字段定位更准,腾讯OCR在低质量截图中鲁棒性更强,阿里云OCR对接飞书多维表格字段映射最顺滑。
添加并配置百度OCR插件
方法一:从插件市场一键安装
登录扣子编程后台 → 进入工作流编辑页 → 点击左侧「插件」栏 → 搜索“百度OCR” → 找到官方认证插件(图标带蓝标)→ 点击「添加」→ 自动跳转至插件配置页。
方法二:手动填写API凭证(仅限已开通百度智能云账号)
在插件配置页,关闭「使用平台托管密钥」开关 → 手动填入你在百度智能云控制台创建应用后生成的 【API Key】 和 【Secret Key】 → 点击「测试连接」,返回 status=0 即表示凭证有效。
⚠️注意:Secret Key 一旦泄露将导致账户被盗用,切勿粘贴到提示词或日志输出中;测试通过后立即点击「保存配置」,否则后续节点无法调用。
在工作流中调用OCR识别节点
第一步:拖入「百度OCR」节点到画布,置于「开始节点」之后、「大模型节点」之前。
第二步:双击该节点,设置输入参数:
Excel/CSV与飞书表格(多维表格/电子表格)双向转换工具。支持:1. 导入Excel到多维表格(创建新表或同步到现有表);2. 从多维表格/电子表格导出数据为CSV或Excel格式。自动识别URL类型,智能推断字段类型。
• 「图像来源」选「上一节点输出」→ 若前序是文件上传节点,则选 Array
• 「识别类型」下拉选择「增值税发票」——这是最关键的一步,选错类型会导致发票代码、税号等字段提取失败;
• 「返回格式」保持默认 JSON,不要勾选「返回原始图像」,否则会增大传输体积并干扰后续解析。
第三步:点击「运行测试」,上传一张清晰的PDF或JPG格式发票,观察输出是否包含 "invoice_code"、"invoice_number"、"amount" 等字段。若返回空或报错 code=282000,说明图像分辨率低于150dpi或存在严重倾斜,需前置加「图像预处理」节点。
处理OCR结果并映射至飞书表格
OCR节点输出的是原始JSON字符串,不能直接写入飞书多维表格,必须经大模型清洗后结构化。
添加一个「大模型节点」→ 重命名为「结构化发票数据」→ 在系统提示词中强制要求输出纯JSON数组,字段名与飞书表格列名严格一致,例如:
"购买方名称" → 对应飞书表中「采购方公司名称」列;
"金额" → 对应飞书表中「含税金额」列,且必须为数字类型(不能带“元”字或逗号);
"开票日期" → 必须转为 YYYY-MM-DD 格式,如"2026/05/20"要输出为"2026-05-20"。
最后接入「飞书多维表格」节点,选择目标表格和视图,在「字段映射」界面手动将大模型输出的每个JSON键拖拽到对应表格列,点击「保存并发布」。









