这是设计如此,不是没做完:OCR(Optical Character Recognition,光学字符识别)按页处理、按页结算,所以每张图片输出一个与原图同名的文件,不会自动拼接;每份 PDF 也只输出一个文件。你传 20 张照片,拿到的就是 20 个 TXT(UTF-8 纯文本),文件名跟原图一一对应。想只得到一个成品,就得在上传前自己造出「一个文件」——把图合成一份 PDF,或者选图片和 PDF 都能收的那个入口。

一、为什么不自动拼

三个理由,都和你怎么核对结果有关:

  1. 点数是按页扣的,产物按页落地,才对得上账。哪一页掉了字、哪一页是空白,看文件名就知道去哪张原图复核。
  2. 拼接要定顺序。照片的文件名和时间戳未必反映正确页序,自动排序会把第 3 页接到第 12 页后面,这种错比多下几个文件更难发现。
  3. 版面信息不可靠。文字类入口只输出文字与换行,不还原分栏、表格线、图片位置、页眉页脚和字体样式,硬拼成一份长文档反而没法修。

一句能力判定:能把每一页各自变成可编辑文字,不能替你把 20 页自动装订成一份带页序的文档。

二、想要一份合并成品,两条路

你的输入走法产物
20 张照片,要一份文档先把图合成一份 PDF,再走「扫描件PDF转Word」DOCX(2007 及以上的 Word 文档格式)一个文件
图片和 PDF 混在一起走「手写笔记转Word」,它是唯一两者都收且可混传的入口DOCX
就要一堆纯文字稿逐张走「图片转文字」,事后自己按序粘进一个文件20 个 TXT
表格照片要一张总表走「表格识别转Excel」,多个表排在同一工作表里、表间空一行XLSX(2007 及以上的表格文件格式)

注意第二行的口径:这里的「多个表排在同一个工作表」指的是同一张图片里的多个表格,不等于把多张图片的表格并成一个文件。

三、批量之前按这个顺序检查

  1. 先确认页序。把照片在相册里按正确顺序重命名或排好,再做合成,别指望识别端替你判断先后。
  2. 转正与裁边。文字类入口会尝试纠正整页转了 90 度或 180 度的情况,歪斜和局部旋转不在范围内;模糊、反光、阴影、手指遮挡都会掉字。
  3. 剔掉空白页。双面扫描最常见的浪费是把空白背面一起交上去,它照样扣点且不写进输出。
  4. 看清格式与上限。图片档只收 JPG、JPEG、PNG、BMP、WEBP,不收 GIF 和 TIFF,多帧图片只取第一帧;单次数量和页数有上限,见工具页提示;单文件上限 8MB。
  5. 当天下载。文件在服务器临时存储,保留 24 小时后自动清理,已下载过的清理更快,20 个文件散落各处的风险就是你没及时收。

四、分场景怎么选入口

  • 一批截图要留文字底稿:走 图片转文字,一页 1 点,接受多文件结果最省事。
  • 一份完整的书稿或合同,最终要交出去:先合成为 PDF 再走「扫描件PDF转Word」,只收 PDF,一步出一个 DOCX。
  • 会议记录既有拍的纸又有打印页:走「手写笔记转Word」,混着一次交上去。
  • 台账、清单这类结构件:印刷体走「表格识别转Excel」2 点,含手填走「手写表格转Excel」3 点。

判据仍是两问:有没有手写笔迹,要出字、出文档还是出表格。挂错档不只多扣点,还会让手填那几格整段消失。

常见问题

问:能不能一次就把 20 张的结果粘成一个 txt?
答:站内不做跨图片的自动拼接;把这 20 张先合成一份 PDF 再走识别,才会得到一个文件。

问:文件名会不会对不上我原来的照片?
答:产物与原图同名,正是为了让你按名字回去核对那一张。

问:不登录能不能先把这一批跑完?
答:不能,游客不开放识别,因为每一次识别都要向云服务商付费;注册后即可使用并拿到一次性赠送额度。

本站能力与限额说明

站内 图片转文字,逐张上传图片逐张出 TXT;识别在服务器端完成,成品请当天下载。

不能做的是:跨图片自动合并、还原分栏与页眉页脚、字段抽取、翻译、印章与公式与竖排古文识别。额度口径:每一次识别都要向云服务商付费,所以游客不开放识别,注册后即可使用;一页扣几点按能力不同(通用文字与手写文字 1 点、表格 2 点、手写表格 3 点);每日识别量有上限。具体点数余额与每日上限以 会员页 为准。

单文件上限 8MB;文件处理完保留 24 小时,到期自动清理。识别按额度点数计、不按次数计,不要把转换类的每日次数口径当成页数限制。VIP 会员单文件上限随档位提高到 20~50MB。