「表格转 Excel」这一件事在站内是两个页面:表格识别转Excel 面向印刷体表格,手写表格转Excel 面向手写表格。它们调用的接口不同、支持的输入不同、连供应商数量都不同。走错了不会报错,只会给出一份看起来能用、实际错很多的表。
三个信号判断该走哪一页
表格里的数字是谁写的? 打印出来的是印刷体,笔写的是手写。混合页要拆开分别处理,不要指望一次搞定。
原稿有没有表格线? 两个工具都需要线条推断边界,但手写这一页对表格线更严格 —— 站内给的建议是「先在纸上画好格子再填写」。
原稿是 PDF 还是图片? 这是最硬的差别:手写这一页只收图片,PDF 不支持;印刷体那一页同样只收图片。要处理表格类 PDF,都得先 PDF 转图片。
走错后的三种典型症状
把手写表丢进印刷体工具:识别会挑字形最接近的印刷字符去猜,结果是数字大面积出错 —— 手写 1 认成印刷 7、手写 0 认成 6 这类错误成批出现。错字比空白更危险,因为它没有失败提示。
把印刷表丢进手写工具:工整印刷体通常也能出结果,但这是另一个计费产品,白扣页数,而且拿不到印刷体工具该有的稳定性。
混排页只走一个工具:表格是印刷的、填写内容是手写的 —— 这是单据最常见的形态。结果是空格子都对、填过的行全错。正确做法是按行分流,或干脆把手写内容留空手填。
一个关键差别:有没有备用供应商
手写表格识别目前只有阿里云读光提供,百度智能云没有对应产品,因此这一页没有备用供应商可以自动切换。阿里侧欠费、限流或故障时,这一页会直接返回失败提示。
印刷体表格、通用文字、手写文字都是双供应商,主家可重试错误(超时、5xx、限流)会自动用备家重跑同一次请求,用户无感知。
两家共有的规则是:识别失败不扣点数。所以这一页报错时不会损失额度,重试即可。
数值处理规则两边一致
默认按文本写入,只有无前导零且不超过 15 位有效数字的内容才存成数值;以等号开头的识别结果一律按文本处理,不会在打开文件时被当成公式执行。为什么这么设计见 图片转 Excel 后数字不能求和?按文本写入是故意的。
合并单元格两边都能重建,跨行跨列按识别到的行列范围还原,但边框、底色、字体、列宽都不保留,交付前需要在 Excel 里重新排版。
两个入口扣点不同,且各次分开算
同一张图走不同入口,扣的点数不一样:通用文字识别每页 1 点、表格识别每页 2 点、手写表格每页 3 点。手写表格是六个入口里每页最贵的一档(手写表格这个能力只有一家供应商提供)。
但这三个能力是各自独立计费的产品,同一张图先用「图片转文字」提取一遍、再用表格识别一遍,就会各扣一次,不存在「已经认过了这次免费」。点数从哪儿扣、怎么摊见 几十页扫描件要识别多少钱?按页计费的算法与拆批方法。
两个入口的单次上限相同:注册与会员单次都是 10 页(识别不向游客开放),所以走错入口不会多花页数,只会多花点 —— 一页手写表格 3 点、一页印刷表格 2 点,同样是 10 页,前者的花费是后者的 1.5 倍。
手写的数字识别错误率明显高于印刷体,金额、数量、编号必须逐个核对,验收顺序见 表格识别后怎么验收?五步核完一张表,不靠抽查。