六个识别工具(「图片转文字」「扫描件PDF转Word」「表格识别转Excel」「手写文字识别」「手写笔记转Word」「手写表格转Excel」)共用同一份额度。这意味着没有哪个工具有自己独立的小池子,也没有「先扣这个入口的额度」这种事。总账只有一个数字,四个倍率档决定它掉多快:印刷体文字 1 点/页、手写文字 1 点/页、印刷表格 2 点/页、手写表格 3 点/页。额度池思维的核心因此是:贵的页数只留给便宜的工具做不到的事。

哪些活其实不需要动用贵格

判断标准只有一条:输出要不要行列结构。要结构,才付表格的 2 点或 3 点;只要内容,就用 1 点的文字格。以下这些情况用文字格完全够——

  • 从对账单里查某个金额、某个单号,不需要重建整张表。
  • 合同、通知、制度文件转成可搜索文本;一份表格只想抄三五个字段进已有模板。
  • 手写批示、签名旁的说明文字,本身不在网格里。

反过来,需要拿去做计算、排序、汇总的数据,才值得走「表格识别转Excel」。这条边界的详细对照写在 表格识别扣点的倍率是怎么定的。

一个反直觉的省钱顺序

多数人按材料顺序处理:拿到什么就先跑表格格,觉得一次到位最省事。实际更省的做法是先用 1 点/页扫一遍全部内容,再挑出真正需要结构的那几页重跑。同样 20 页的档案,直接全走表格格要 40 点;先文字格过一遍(20 点),发现只有 5 页是需要建表的,再补 10 点,合计 30 点,还顺手得到了全篇可检索文本。

这个策略的前提是那 5 页确实必须结构化。如果只是想看内容,第一遍就结束了,成本停在 20 点。

同一种内容也有替代路径能绕开额度

  • 文字型 PDF 不要用「扫描件PDF转Word」。判断方法很简单:文字能不能用鼠标选中复制。能选中的走「PDF转Word」,效果更好且完全不消耗识别额度。这一步常常能砍掉一半需求。
  • 手写的两个入口别混用:只取字用「手写文字识别」(1 点/页),要还原成表格才用「手写表格转Excel」(3 点/页),差三倍。
  • 纯前端那几个文档工具不占额度也不占每日次数,识别后的清理、去重、排序都在那里做,不必重跑一遍。

工具全集在 /ocr-tools,入口选择决定倍率。

团队共用的分配法

同一个账号下所有人共享余额,谁的手写表格多了,别人当天就没点数可用。两条纪律最有效:给贵格设审批线,3 点/页只在必须交付结构化数据时用;按用途拆时间而不是拆人,本周只做归档(全走文字格),下周集中建表,避免两种需求在同一天互相挤兑。批次排产的算法见 几十页扫描件要识别多少钱。

底线判断:共用额度这件事本身不造成浪费,错配入口才造成浪费。每次上传前问一句「这份东西的最终用途是能被搜索、还是能被计算」——只需要被搜索的用 1 点格,需要被计算的才允许动 2 点和 3 点格。守住这一条,同样的预算能做的页数通常翻倍。