出来的那一句就是首帧上的文字。多帧图片只取第一帧,后面所有帧都不参与识别,所以动图看着字很多,结果却只有一行是正常表现,不是漏识别。

一、先分清两件事

情况站内是否接收结果
单帧 JPG、JPEG、PNG、BMP、WEBP收按这一张出文字
多帧但容器受支持收只取第一帧,其余丢弃
后缀为 GIF 的动图不收四个图片档明确排除 GIF 与 TIFF
TIFF 多页扫描不收站内也没有它的转换入口

边界说明白:能取字的只有第一帧,不能顺带把后续帧拼进来。GIF 属于不支持格式,要在本地看图软件里另存为 PNG 或 JPG。

二、逐帧取字的走法

  1. 在本地把动图逐帧导出为静态图,命名保留顺序,便于事后对回原帧。
  2. 检查每一帧的字:过小、发虚、被贴纸或遮罩压住的字帧,重导时挑清晰的那一帧。
  3. 把透明底帧先铺白底再传,系统对透明底图片也是先拍平再处理,提前处理可少一层失真。
  4. 逐张上传,每张图片输出一个与原图同名的 TXT,不会自动拼接,需要自己按序合并。

三、为什么不建议拿动图凑合

动图普遍经过压缩,字边缘发糊;WEBP 以及体积偏大的图还会先重编码成 JPEG 再送识别,多一道编码,小字和浅字会再降一档。叠加「只取第一帧」这条规则,整段内容大概率只剩零头。想要完整文字,源头就该是一张清晰的静态截图,而不是层层压缩后的动图。

四、扣点与报错口径

项目口径
通用文字与手写文字每页 1 点
表格每页 2 点
手写表格每页 3 点
无法解码或服务商报错失败那页不扣点
整份识别不出文字报错且不退

一张动图不论有几帧,都只按一张图计算,不会因为帧多而多扣,也不会因为只出一句就退点。空白帧照样扣 1 点且不写进输出。

常见问题

问:有没有办法让它把所有帧拼成一段?
答:没有,也不提供视频或动图拆帧功能,必须先在本地拆好。

问:手机上能做吗?
答:识别本身浏览器就能用,但拆帧要借助本地看图工具;游客不开放识别,注册后有一次性赠送额度。

问:结果里字都对,为什么顺序乱了?
答:只输出文字与换行,不还原分栏、图片位置与字体样式,跨栏内容会按读取顺序排。

本站能力与限额说明

站内 图片转文字,接收 JPG、JPEG、PNG、BMP、WEBP 五种图片,每张图片输出一个同名 TXT;如果内容是卡片式网格,改走 表格识别转Excel。识别调用云端文字服务,每一次都要向服务商付费,所以游客不开放识别,注册后即可使用;一页扣几点按能力不同,通用与手写 1 点、表格 2 点、手写表格 3 点,每日识别量有上限。

识别不收 GIF 与 TIFF,多帧图片只取第一帧;结果不含印章、数学公式、竖排古文与涂改覆盖的内容,也不做字段抽取与翻译。

注册用户有一次性赠送额度且永久有效,VIP 每月另有配额,各档当前售价与额度以 会员页 为准。识别按额度点数计、不按次数计,单文件上限 8MB,文件处理完保留 24 小时、到期自动清理,成品请当天下载。