codex发票识别工具可批量处理pdf电子发票,自动提取字段、查重分类、本地验真并导出excel。下载v3.2.1版解压运行后,启用本地解析引擎,设置命名规则与自动查重,一键完成470张发票处理(约10分钟),全程离线保障数据安全。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

每个月报销季,财务人员面对几百张电子发票PDF文件,既要自动提取发票代码、金额、开票日期等字段填入Excel,又要批量验真并分类归档——手动一张张打开、截图、录入、比对,不仅耗时,还极易漏查重复票或假票。
下载与启动Codex发票识别工具
在电脑浏览器中搜索「Win10版Codex发票批量识别」,进入官网或「天才小网管」公众号下载页面,获取最新版压缩包(截至2026年6月,版本号为v3.2.1)。【解压密码为123456,输入错误将无法释放核心识别模块】
右键压缩包→选择「解压到当前文件夹」→双击运行橙色图标【CodexInvoice.exe】。软件无需安装,绿色免注册,启动后主界面即显示「工作台」、「设置」、「帮助」三大区域。
导入发票文件并启用本地解析
点击「工作台」→第一个输入框旁的「浏览」按钮→定位到存放发票PDF的文件夹(仅支持PDF格式,OFD/XML暂不兼容)。
勾选「启用本地解析引擎」:该选项强制绕过云端OCR,所有发票内容在本机CPU解密解析,【不上传任何数据,避免税务敏感信息泄露】。未勾选时软件会默认调用网络接口,触发弹窗要求登录并充值,影响批量处理连续性。
确认路径无误后,右侧状态栏将实时显示“已加载XX张发票”,若出现灰色“跳过”字样,说明该PDF含加密权限或扫描图非文本型,需提前用Adobe Acrobat另存为可选中文本的PDF。
通过本地 Codex 或 OpenClaw OAuth 凭证直接调用 ChatGPT/Codex Responses 的 image_generation 工具来生成或编辑光栅图像,然后保存
一键执行四大任务:导出→命名→分类→验真
第一步:点击「设置」→开启「自动查重」和「发票分类」开关;再点击「点击此处设置命名规则」→为增值税专用发票设定模板:{购方}{金额}{开票日期:yyMMdd},例如“华为技术有限公司_¥12800_250615.pdf”。
第二步:返回「工作台」→第二个输入框选择Excel导出路径→点击「一键整理导出」按钮。
第三步:软件开始逐张解析PDF结构体,提取发票代码、号码、校验码、开票日期、金额、销方名称等17个字段;同步比对本地历史发票哈希值标记重复票;按税种自动分入「专票」「普票」「电子普票」「机动车票」「通行费票」五个子文件夹。
第四步:对每张发票调用税务总局查验接口(使用国税官网同源验证逻辑),返回结果直接写入Excel“查验状态”列,成功则标绿“真”,失败则标红“验签异常”,超时则标黄“网络未响应”。整个过程平均1.3秒/张,470张发票约10分钟完成。
导出的Excel文件包含原始字段+查验时间戳+分类标签+重复标识,可直接作为报销附件提交;生成的五个分类文件夹内,发票均已按规则重命名完毕,双击即可打开查看。










