平板里的笔记看起来是「已经是电子版了」,但对识别来说它和一张纸没区别:你需要的是一幅字迹清晰、页面完整的位图或 PDF。取这一份文件有两种方式,差别很大。
整本导出和逐页截图,差在哪
导出成 PDF:由笔记 App 自己排版输出,每页干净白底、完整、无状态栏、比例正确。这条路的分辨率取决于导出设置,多数情况够用。
截图当前页面:带上工具栏、边缘裁切和屏幕像素上限。放大到能看清笔迹时一页要截四张,拼起来还有接缝;缩小看整页时,笔画压到几个像素高,细节全丢。
结论很直接:优先整本导出 PDF。只有「导出为图片」选项的,记得选最高质量档。
150 DPI 这条线怎么影响你的选择
本站对扫描型 PDF 的处理方式是每页按 150 DPI 渲染成图后再识别。这带来两个后果:
一是上传高分辨率 PDF 不会得到更细的结果,密度已经被这一步定住。二是反过来,如果你在原稿里就是很小的字,150 DPI 下每个字的笔画数可能已经不够。验法很朴素:把导出的 PDF 放到电脑上按实际尺寸显示,肉眼不费劲能认出的字,识别才有机会。
导出的是图片而非 PDF 时还有一条硬规则:长边超过 8000 像素会等比缩小后再识别,别为了清楚而故意拉成超大图。
入口怎么选:三种笔记三条路
- 纯手写正文(课堂记录、会议速记)走 手写笔记转Word,它接受手写照片或含手写内容的 PDF,输出 DOCX。只要文字不在乎版面的用「手写文字识别」,每张图 1 点。
- 画了表格的页面(默写格、排期网格)另算:印刷表格每页扣 2 点,手写表格每页扣 3 点,而且表格类输入不支持 PDF,手写表格也不支持 PDF。必须先把那一页单独导出成图片再走「手写表格转Excel」。
- 半页手写加半页打印体的混排,一次识别很难两边都好:按区域裁开分别走两个入口,取字后手工合并。
识别返回空白时的排查顺序
- 先确认入口。把纯手写丢进印刷体入口,最常见的结果就是几乎什么都没有 —— 空白往往是内容类型判定问题,不是字迹问题。
- 再看格式。HEIC 与 TIFF 都不在支持的输入清单内,只接受 JPG、JPEG、PNG、BMP、WEBP(PDF 入口除外)。
- 检查页数是否被空白页吃掉。PDF 里的空白页同样按 1 页计、扣 1 点,但不写入输出文档 —— 笔记 App 常在末尾留几张空页,识别前清掉。
- 取样验证。只挑字迹最工整的一页先试,1 点换一次确定性;整本一起提交后发现全线不行,成本就高了。
更多成因见 手写识别返回空白怎么办。
底线判断
工整字迹可用,连笔、草书、字迹过密或过淡时准确率明显下降,重要内容必须人工核对。笔记里有公式、图形、竖排文字的,这些属于无法可靠识别的范围,只能取出周边说明性文字。如果目的只是让笔记可搜索,笔记 App 自带的功能通常更贴合它的笔迹;走到外部识别这一步,多半是因为你要一份能继续编辑的 Word 或 Excel。