原因很具体:一次识别要把你的图片加密发送给第三方供应商,供应商按调用量向本站收费。这份成本随页数线性增长,站内没有任何环节能把它吸收掉。转换不一样,合并拆分转格式全部在本站服务器上跑,用的是自己的 CPU 与带宽,边际成本低到可以忽略,所以敢做成免费每天 5 次。

一笔账拆开看

一张 A4 扫描件走识别,中间发生的事是:本站把 PDF 每页按 150 DPI 渲染成图,加密上传给供应商,等对方返回文字或表格结构,再把结果整理成 DOCX 或 XLSX 回给你。真正贵的是第三步,那是别人的机器、别人的模型、别人的账单。

转换的路径没有第三步。文件传上来、本站自己算、结果传回去,全程不产生外部账单。所以「转换免费」不是补贴,是成本结构本来就不同。

倍率也是这么来的

四类内容每页扣点不同:印刷体文字 1 点、手写文字 1 点、印刷表格 2 点、手写表格 3 点。表格类扣得高,是因为表格识别与手写表格识别在供应商侧是完全独立计费的产品,跟页面漂亮与否无关。手写表格只有阿里云读光一家提供,手写文字只有百度智能云提供,通用文字由百度优先、阿里备援,表格由阿里优先、百度备援——只有一家能做的东西,没有比价空间。

那免费站靠什么活着

本站的免费部分覆盖纯转换类工具,识别部分要求登录、游客不开放,注册一次性赠送 5 点。这个设计不是为了卡你,而是控制成本:不限制的话,机器流量一晚上能把真实用户的预算吃空。

额度规则也解释了价格构成:会员每月配额月卡 20 点、半年卡 30 点、年卡 45 点、银卡 65 点、金卡 120 点,当月用不完不结转;页数包体验包 100 点 12.9 元、常用包 500 点 49.9 元永久有效。供应商调用失败的那一页不扣点,因为那一页确实没产生费用。

什么时候这钱不该花

  • 材料本身是文字型 PDF,用鼠标能选中复制的,走 PDF转Word,不消耗识别额度,没必要花钱
  • 只要两三个字段,肉眼抄完比识别加核对更快
  • 合同金额、工资数字、报税数据这类要对外负责的内容,无论多少页都建议回原图逐格录入,省下的那点时间抵不上一次错字的代价
  • 想批量对接自己系统的,本站不提供对外接口,也没有代客录入服务

底线判断

识别收费不是套路的借口,而是可核对的成本:图片外发给供应商这件事本身就意味着服务费。愿意为省下的几小时付钱就用,不愿意就手敲,两条路都正当。至于「凭什么别处免费」,别处也要么限次数要么把你的图存下来做训练料,看清留存条款再决定。更细的口径差异见 识别额度与转换次数的区别,付费档位写在 /vip。