文件转换与处理的实用图文教程,每篇解决一个真实问题
两百页按班次切成白班、中班、夜班三份分别处理,比一次全塞省事:顶住单次页数上限的概率下降,失败只重跑那一份。每份做完立刻下载并核对页码连续性,缺页当天补扫;识别按页计额度点数。
讲清插入题注的完整路径、编号自动重排的原理、正文为什么要用交叉引用,以及导出 PDF 前必须更新域的那一步
先删掉多余的封面和空白页再加码,加了码再动页面顺序等于全部重来。判断起点看的是正文第一页在文件里排第几,不是它印着的数字。
图多的文件压图才有效,字多的纯文字文件基本压不动;扫描件压过头会让小字和印章一起消失。判断方法是看转成图片后那一页还剩什么。
贴图只解决看起来签了,能证明是谁签的靠签署过程留痕与文件定版。正文改完转出终稿再贴,叠一层签署方与日期的浅色字样,交付前设打开密码并走另一条通道告知;重要合同的效力另行评估。
页面含细线、小字号或纯色块时选 PNG,整页照片或渐变选 JPG;差别不在清晰度上限,而在 JPG 处理硬边缘的方式。批量前先挑线条最密、字号最小的那一页各出一份,放到百分之百比表格线与最小字号的边缘再定。
跑位只有两种成因:原文用了未嵌入的字体,或者根本没有文字层。前者能改字但版式必变,后者选中会整块高亮,只能走识别而不是重转。
自动目录的前提是给标题套用“标题 1/2/3”样式,而不是手动加大字号。目录生成后最常见的三个问题是层级不对、页码不更新、出现了不该有的条目,本文逐项说明修哪个设置。
先过两个前提:是文字型 PDF、没有打开密码;过了就是上传、转换、下载三步。任一前提不成立时该换 OCR 那条路,而不是反复重试同一个按钮。
账号、证件号、住址门牌、通讯记录属高频必遮项。遮挡要用不透明填充彻底抹掉原像素,半透明色块和画笔描边都不算脱敏;文字类材料优先整页删除而不是逐字遮盖。
顺序是 HEIC 先转 JPG、再压体积、最后合成 PDF。反过来做等于把已经糊过的图再糊一次,页面数和清晰度都会失控,报名附件最容易死在这一步。
本文说明碎线的来源是原图边缘对比度不足,提高反差比事后删线有效;只有高反差线条图值得转,照片类基本不可用,删干净的时间足够照着底图重画一遍。