中文博客 / 财务工作流
出海团队 · 发票 OCR

拿 OCR 做发票对账,最容易踩的不是识别率

真正麻烦的是:它大部分都识别对了,于是你开始相信那几个刚好识别错的数字。

2026 年 9 月 15 日

海外 SaaS、广告平台、物流、云服务、设计外包,各种发票格式凑在一起以后,人工录入确实很烦。OCR 很适合先把东西“扫进来”,但我不会直接把 OCR 结果当账。

原因很简单:财务场景不是平均准确率游戏。正文里错两个单词可能没事,金额少一个 0、日期从 09/12 读成 09/17、EUR 读成 USD,就完全是另一回事。

我会把字段分成“可以错”和“不能错”

供应商地址少一个标点,通常问题不大。真正要盯的是供应商名称、invoice number、开票日期、币种、subtotal、tax、total,以及你们内部用来匹配付款记录的编号。

这几项最好在界面上单独高亮,让人快速核一遍。比起追求“99% OCR accuracy”,我更愿意要一个能告诉我“这几个数字我不太确定”的工具。

多币种和欧洲小数点很容易制造假熟悉感

1,234.56 和 1.234,56 对不同国家意味着完全不同的数字格式。跨境团队最容易犯的错就是把自己熟悉的格式当成全球默认。OCR 能把字符读出来,但后面的解析规则如果写得太自信,一样会出错。

日期也类似。03/04/2026 到底是 3 月 4 日还是 4 月 3 日,不能只靠字符串本身猜。最好结合供应商地区、发票语言和原图一起判断。

为什么我偏向本地 OCR

发票不是什么“绝密文件”,但它经常包含公司全名、地址、税号、采购内容、供应商、价格、付款信息,有时候还有联系人邮箱。把这些文件为了 OCR 再上传到一个不熟悉的转换站,多少有点倒因为果。

如果浏览器就能识别,处理链路会更简单:原文件留本地,OCR 只负责出草稿,关键字段人工复核,然后再进你真正的财务系统。

最实用的不是自动化到零人工

我更喜欢 80% 自动:OCR 帮你省掉重复打字,人只看最危险的 20%。这种流程比“全自动识别 + 事后发现账不对”省心很多。

对账不是 OCR benchmark。最后决定质量的,是关键字段有没有被单独验证。

先把发票变成可搜索文本

Local OCR 可以在浏览器里提取图片和 PDF 的文字,适合作为录入前的第一步。

打开 Local OCR →