直接传 PDF。走 扫描件PDF转Word 时页面由服务器按固定精度取图,跟你先自己转一遍花的点一样,中间却少一道压缩损失。

一、能进识别的 PDF 只有两条路

入口输入产物适用
扫描件PDF转Word仅 PDFDOCX印刷体扫描件
手写笔记转Word图片与 PDFDOCX稿子里有手写字
图片转文字仅图片TXT手上已是照片

除这两条之外,任何 PDF 都要先变成图片才认。也就是说,如果你的目标是 Excel 或者只是纯文本,绕不开先取图。

二、先转图片会不会更省

不会。一份 PDF 进去是逐页处理,十页就算十页;先转成十张图再传,还是十页。点数按页计,取图那一步属于格式转换、不消耗识别额度,所以两条路的总账基本相同。

差别在画质上:站内的渲染精度是既定的,你自己那份 PDF 是高清还是低清不会改变它。而手动转图片要多过一次编码,浅字和小字会在这道里再掉一档。

三、什么时候确实该先转图片

  1. 只要其中几页:先拆出那几页,避免为无关页面付点。
  2. 页面方向乱、有阴影或反光:本地修完再传,比识别一遍错的结果便宜。
  3. 目标是表格:表格档只收图片,本来就得先取图。
  4. 手上是聊天软件里收回来的照片:已经压过一道,走 图片转文字 直接传即可。

四、两条路的实际差别在哪

  • 等待:整份上传只需一次交互;先转图要跑两个工具。
  • 产物:PDF 出一份同名文档;图片每张各出一份,要自己合。
  • 可控性:先转图能挑页、能改亮度;直接传 PDF 只能整份进。

五、这几件事别做

  • 别为了「提高精度」去导出超高像素的图:长边超上限会被等比缩小,白占体积。
  • 别把透明底的截图直接传:铺白底这件事站内会做,但深色背景合成的图要靠你自己换。
  • 别用截屏代替原件:屏幕分辨率低于任何一份正常扫描件。
  • 别一趟传完整本:单次页数有上限,量大分批更稳。

常见问题

问:加密的扫描件能做吗?
答:不能直接传,要先去掉密码,任何识别入口都不收加密件。

问:GIF 或 TIFF 的扫描图怎么办?
答:这两个格式都不收,站内也没有它们的转格式工具,只能先把图另存为 JPG 或 PNG 再传。

问:识别结果能保证全对吗?
答:不能,本站不承诺识别率,重要数字必须回原页核对。

本站能力与限额说明

站内 扫描件PDF转Word,整份 PDF 逐页送服务器识别,输出一份同名 DOCX。转换在服务器端完成,特殊字体可能回退,涉密材料请自行评估是否上传。

它只收未加密的 PDF,不出 Excel、不出纯文本,也不还原分栏与表格线。每次识别都要向云服务商付费,游客不开放识别,注册后即可使用;注册时赠送的额度永久有效,VIP 每月另有配额,通用文字每页扣 1 点;每日识别量有上限,超出次日再试或联系站长,售价以 会员页 为准。

单文件上限 8MB,VIP 提高到 20~50MB;识别按点数计、不按次数计。文件保留 24 小时后自动清理,成品当天下载。