"把这张图转成 Word"这句话里,藏着两个完全不同的需求。分错路的结果是:忙了半天得到一份能打开、但一个字都改不了的 Word,或者满篇乱码。

先做一个五秒钟判断

打开你要处理的东西,用鼠标去选一段文字。

  • 选得中:它是文字版 PDF。这条路很顺,直接转 Word,内容和格式都能带走
  • 选不动:它是一张图(照片、截图、扫描件)。这条路必须先经过文字识别(OCR),否则得到的 Word 里只有一张插图

第二种的典型来源:手机拍的书页和合同、微信里收到的截图、打印机扫描出来的 PDF、以及"图片转 PDF"合成出来的文件。特别说明:把照片用 图片转 PDF 合成的文件,仍然是图像型 PDF,转 Word 也拿不到可编辑文字。 这一步是很多人误以为"绕过去了"的地方。

路线一:文字版 PDF → Word(本站直接支持)

用 PDF 转 Word 转出来,然后必须做一次校对。真实的效果边界是:

  • 段落、换行、标题层级基本能带走
  • 表格能转出来,但合并单元格和嵌套表格经常错位
  • 页眉页脚、脚注、目录、多栏排版最容易出问题
  • 字体不会保持原样(原文件用了本机没有的字体时更明显)

所以正确的做法是"转出来当草稿,重排当成品"。排版乱掉的系统排查方法见 PDF 转 Word 后排版全乱?按这五步定位原因,哪些文件效果好的判断依据见 PDF 转 Word 保留排版的现实边界。

路线二:图片 → 可编辑文字(要借用识别能力)

取字这一步站内就有:图片走 图片转文字,PDF 走 扫描件PDF转Word,都是每页扣 1 点,后者单次最多 10 页、不还原版面;排版这一步回到 Word。两件事分开做。

第一步,把图里的字取出来。 手机上长按图片"提取文字"、微信里点开图片用"提取文字"、Windows 截图工具的"文本操作",这三条都不额外装东西,中文识别率也够用。完整对比见 图片里的文字怎么识别出来。

第二步,把取出来的文字整理干净。 识别结果最常见的三类问题:数字与字母混淆(0 和 O、1 和 l)、标点全半角错乱、一个段落被拆成好几行。先粘到纯文本编辑器里,用 删除空行 把断行清理掉,再核对数字和金额。

第三步,在 Word 里排版。 把整理好的文字贴进 Word 做样式。已经有 Word 但格式乱的话,用 清除 Word 格式 把它压成纯文本再重来一次,比在残留样式里逐个改快。

第四步,导出交付件。 需要发给别人、不希望版式被改动时,把 Word 转成 PDF:Word 转 PDF(注意只接受 .docx,老 .doc 要先另存)。

图片很多的时候怎么提高效率

批量处理几十页,逐张识别会让人崩溃。按数据量选:

  • 十页以内:逐张手机识别,粘贴整理。慢但零成本,准确率反而最高,因为每张你都过了一遍眼
  • 几十页且是打印体:把图片先合成一份 PDF(图片转 PDF),再用带 OCR 的桌面软件一次性识别整本。这条路需要装软件,但比逐张快得多
  • 要保留表格结构:别指望图片识别能把表格还原成可用的 Word 表格。表格类内容最省时间的做法是照着图重新录入,或者让对方提供源文件。相关讨论见 PDF 表格怎么转成 Excel

两个提前设防的坑

准确率不是百分之百。 识别出来的数字、姓名、日期、金额必须逐条核对,尤其是合同金额和证件号。把一份有错的稿子交上去,代价远高于当初多花五分钟录。

扫描件转 Word 为什么常常"不可编辑"。 原因和解决边界都写在 PDF 转 Word 为什么不可编辑 里,核心一句话:没有文字层的文件,转换工具只能把整页当图搬过去。

如果你的目的是"内容可用"而不是"版式还原",其实不一定要 Word。想直接放进网页或系统里,用 PDF 转文本 取纯文本,或者 PDF 转 HTML 得到网页版,往往比在 Word 里重排更快。