"把 PDF 里的图片提取出来"这句话,不同人说的其实是三种需求。分清自己是哪一种,能省掉大量试错。
需求一:每一页变成一张图
这是最常见的,用途包括把报告页发朋友圈、把课件页插进 PPT、把合同页逐页发给对方确认。
走 PDF 转图片 就行,一次转换会把所有页逐页导出,不需要设置页码范围。默认输出大约相当于 150 DPI,一张 A4 页面对应 1190px 左右宽度的图像——屏幕阅读、插入 PPT、微信传阅都够清晰,打印大幅海报则不够。
要 JPG 还是要 PNG 可以分开选:照片类内容用 JPG 体积小,含线条、文字、截图的内容用 PNG 边缘更干净。需要提醒的是,PNG 的页面背景是不透明的,PDF 本身没有"透明背景"这个概念,指望转出来的 PNG 带透明通道是个常见误解。
需求二:只要其中几页的图
工具没有"指定页码转图片"的输入框,但结果一样能做到,两步走:
如果原本就只有十几页,还可以直接全部转完,然后在本地把多余的图删掉。页数多时先提取更省事,因为一次导出几十张图再挑,比挑页面前麻烦得多。
需求三:要页面里那张原始照片本身
这个需求的意思是:一份 PDF 里嵌了一张 4000px 的原始照片,你想把这张照片按原始分辨率单独拿出来,不要整页画面。
这属于"抽取内嵌对象",需要在本地解析 PDF 内部结构,浏览器里做不了,本站不提供这个能力。可行的替代方案有两个:
- 先用 PDF 转图片 导出整页,再用 图片裁剪 把照片区域裁出来。缺点是分辨率受页面导出精度限制,放大后会软
- 如果照片是文档作者另外拍过、或在原文件里还能找到,直接找原作者要原图。这是唯一能拿到真正原始分辨率的路
需求四:其实要的是文字和表格
很多人说"提取图片"是因为复制不了 PDF 里的内容,误以为整份文件是图。如果文字能被鼠标选中,说明有文字层,走这两条路更省事:
- 只要纯文字:用 PDF 转文本
- 要保留段落格式:用 PDF 转 Word
真正的扫描件(文字选不动)里没有文字层,抽图这一档取不出字;要把扫描件里的文字变成可编辑内容走 扫描件PDF转Word(每页扣 1 点、单次最多 10 页、不还原版面),相关说明见 扫描版 PDF 转 Word 的现实做法。
提取完之后的批量处理
一次性导出几十张图,接下来通常还有三件事要做。
顺序整理:转出来的图片文件名带页码序号,排序时留意"第10页"在某些系统里会排在"第2页"前面,重命名成两位数页码(01、02)能彻底解决。
体积瘦身:要发出去的图片,先批量 压缩图片,画质看不出差别但体积能降一半以上。
打包发送:需要一次性传给别人时,把散图压缩成一个压缩包,用 ZIP 压缩。批量导出的完整流程和命名习惯,可看 PDF 批量导出图片怎么打包。