先把边界说清楚:本站不做图片透视矫正,也没有拉直歪斜页面的功能。手机上那些扫描 App 之所以能把梯形页变成方正 PDF,是它们本地做了几何变换,这一步在这里没有。所以拍歪了只有两条路:重拍,或者在按快门前就把角度做对。
歪斜到底破坏了什么
识别面向的是横平竖直的文字行。一旦页面出现明显透视,同一行字的左右两端高度不同,字距被压缩,远端那半行的实际像素数会掉到临界值以下。表现不是整段乱码,而是近端正常、越往远端漏得越多,最后几行干脆消失。表格受影响更严重,列边界一歪就会把两列并成一列,事后重排的成本远高于重拍十秒。
轻度倾斜(几度以内)通常还能读出来;当你肉眼已经觉得「这页是梯形」时,就已经超出可用范围了。
不用矫正也能拍正的取景法
- 把纸放在有直边的桌面上,先用手把四个角捋平,卷边的纸怎么拍都会变形。
- 手机不要悬空。把机身背部下边缘贴在桌面上,让它撑住一个固定高度,比手持稳得多。
- 对准的方式很简单:看屏幕里手机的取景框四条边,让它们和纸的四条边走向一致。上下等宽、左右等宽,就说明基本平行。
- 退半步,保证四个角全部入镜并且离画面边缘留一点距离。宁可多拍进一圈桌面。
- 保持这个姿势连拍多页,每页只换纸不换机位,整套图的角度就统一了。
已经拍歪了,哪些补救有效哪些无效
放大没用。走 修改图片尺寸 只是等比改变像素数,梯形还是梯形,远端该丢的字照样丢。裁剪能间接帮上忙:把畸变最严重的远端那一截裁掉,剩下的近端区域行向接近平直,可以先取出这部分内容,缺的行再补拍一张近景。这条路只适合抢救局部,不适合整页交付。
真正需要方正影像件时(比如归档或提交),正确做法是回到原工具或系统自带的文档扫描里做完矫正再导出,然后把矫正后的图拿来识别。本站承担的是识别这一段,不承担几何修正那一段。
一页里既有歪又有反光
先解决反光,再解决角度。反光是信息缺失,角度是信息变形;缺失无法补,变形至少还能靠重拍消除。两个问题同时存在时,任何一次重拍都要先把光调对,否则换个角度又撞上新的高光位置。影响程度排序可以看 拍照清晰度如何影响识别率。
底线判断
两三页材料,重拍永远比修图快。十几页以上且必须方正,就别用手机的自动增强链路硬扛 —— 那种情况下要么找到原始电子文件,要么借用带自动裁边矫正的扫描设备取底图,识别这一环节留给本站的工具去做它擅长的部分。