这站不写准确率百分比,也不写「高达九成」这类说法。理由是同一个数太依赖输入条件:同一套识别服务,面对干净的印刷页和一张潦草的手写单据,结果能差出几十个点,报出来就是误导。能给的是定性边界:能认印刷体和工整手写,不能认印章、数学公式、竖排古文和被涂改覆盖的内容;手写数字比印刷体更容易错,金额、数量、编号必须逐个核对。
一、为什么不报一个数
OCR(Optical Character Recognition,光学字符识别)的出错不均匀:一处认错可能整行都偏,也可能全页只错一个字。压成一个百分比,等于把风险藏进平均值里。真正决定结果的是这几项:
| 影响项 | 后果 | 你能做什么 |
|---|---|---|
| 工整还是连笔草书 | 草书明显下降甚至整句丢 | 逐字核对,关键项手抄 |
| 字号过小、笔画过淡 | 整段掉字 | 裁出那块放大后单独传 |
| 反光、阴影、手指遮挡 | 被遮区随机缺字 | 重拍,光源在侧不在正对 |
| 页面倾斜或旋转 | 行的基线散开 | 先在相册自带编辑里转正 |
判据一句:越接近平整、清晰、正对、字大越可用;这四项塌两项,产物只能当草稿看。
二、什么能直接用,什么一定要校
可以直接用的:排版规整的印刷文档、书页、合同正文、界面截图。这类走 图片转文字,一页扣 1 点,产物是 TXT(UTF-8 纯文本),只输出文字与换行。
必须逐字校的:所有手写内容。手写数字的错误率高于印刷体,单据上的金额小写、数量、编号任何一个认错都是钱货差错。统一口径是:工整字迹可用,连笔、草书、字迹过密过淡时准确率明显下降,任何手写结果都要人工校对后再用。
三、想少返工,按这个顺序做
- 先分类。把图分成纯印刷与含手写两堆,混在一起的按含手写处理,判据是有没有手写笔迹,不是像不像表单。
- 关键数字回原图核。金额、数量、编号、日期对着纸面复核,不要看着产物顺手改。
四、哪些不是难认,是根本不认
能力边界一句说死:能把一整页印刷正文交成可编辑文字,不能把印章里的单位名读给你,也不能在被涂改的那一格上给出可信答案。
- 印章与盖在字上的红章:不提供印章识别,章下的字也不保证读得出。
- 数学公式:不解析结构,分数、上下标会散成一行乱码。
- 竖排古文:不支持竖排版式。
- 涂改覆盖的内容:划掉或盖住的部分不做还原。
- 翻译:图上是什么语言就出什么语言,不做语种转换。
常见问题
问:那我怎么判断自己这批图值不值得传?
答:先用最清楚的一页试一次,看清数字对不对再决定其余的,这一步只消耗一页点数。
问:手机上能做吗,要不要装东西?
答:能,浏览器里直接传图即可;单次数量和页数有上限,见工具页提示。
问:不登录能不能先跑一页看看?
答:不能,游客不开放识别,因为每一次识别都要向云服务商付费;注册后即可使用。
本站能力与限额说明
站内 手写文字识别,把手写笔迹的图片交给它出 TXT,工整字迹可用、潦草字迹按草稿对待;识别在服务器端完成,成品请当天下载。
不能做的是:给出准确率承诺、识别印章与公式与竖排古文与涂改内容、拆分字段、翻译,也不还原分栏和字体样式。额度口径:每一次识别都要向云服务商付费,所以游客不开放识别,注册后即可使用;一页扣几点按能力不同(通用文字与手写文字 1 点、表格 2 点、手写表格 3 点);每日识别量有上限。具体点数余额与每日上限以 会员页 为准。
单文件上限 8MB;文件处理完保留 24 小时,到期自动清理,已下载过的更快。识别按额度点数计、不按次数计。VIP 会员单文件上限随档位提高到 20~50MB。涉密材料请自行评估是否上传。