识别失败最常见的原因不在识别本身,而在上传这一步。按提示对号入座即可,其中第六条最容易让人莫名其妙。

一、格式不支持

白名单只有 JPG、JPEG、PNG、BMP、WEBP,PDF 类入口另收 PDF。提示会写「不支持的文件类型」并列出可接受的扩展名。

  • iPhone 的 HEIC 不在其中:先用 HEIC转JPG 转一次再上传,这一步走转换额度、不占识别页数
  • TIFF、GIF 也不行:即使某些看图软件能打开,本站的图片工具同样不收这两种格式。请用系统自带的看图、截图工具另存为 PNG 或 JPG 后再上传
  • 改后缀没用:把 heic 改成 jpg 只会在解码时失败

二、体积超限

提示「单文件过大,当前身份最大 8MB,升级可提升额度」。免费与未充值用户单文件 8MB,VIP 月卡 20MB、半年卡 30MB、年卡/银卡/金卡 50MB。

不要用压缩工具硬压到 8MB 以内:每一轮有损压缩都在吃掉笔画边缘,省下的体积会换成识别错误。相机直出的超大图,用图片压缩时把质量留住,或者只裁出要认的区域 —— 裁剪后的像素量本身就小。

三、像素太大

长边超过 8000 像素会自动等比缩小后再送识别,不会报错,但缩完可能踩到另一头:文字长边不足 1000 像素时容易漏识。所以「手机最高像素模式」对识别并不更好,一般文档 1500 到 3000 像素足够。

四、排队已满

提示「当前 OCR 识别排队已满,请稍后再试。」同时处理的任务有并发上限,等十几秒原样重新提交即可,这次不扣页数。

五、能力未开通

提示「该识别能力暂未开通,请改用其它识别工具」。个别能力只有一家供应商支持(比如手写表格),后台关闭或供应商不可用时就会出现,与你的文件无关。

六、静默改名:文件名里有特殊符号

上传时文件名会做一次净化,只保留中英文字母、数字、空格和少数符号(连字符、点、下划线、括号),超过 150 字符或含其它符号时,整个文件名会被替换成 file_0、file_1 这样的占位名。

于是出现一个现象:上传「报价单(最终版)#3&含税.jpg」,下载回来的 TXT 叫 file_0.txt。内容没问题,但批量识别十几张后,你分不清哪个是哪个。

规避办法是上传前先把文件名整理成干净格式,用批量重命名统一改成「日期-编号」这类只含字母数字连字符的写法,再拖进识别。已经变成占位名的,识别完按内容重新命名即可。

还有一种不是失败:结果是空的

图片过于模糊、被拉伸变形、或者干脆没有文字时,调用会成功但输出空白 —— 这一页照样计入页数。传之前把图放大到 100% 看一眼字的边缘,比事后追问为什么没内容有用。字太小导致认不全的判断方法见 长截图、密集小字识别不全?卡住你的是一条像素密度门槛。