板书和会议纪要不一样,它有三个特征同时踩在识别的弱点上:字是手写的、版面是空间分布的、拍摄环境通常最糟。所以先把预期放对:这类照片不属于印刷体识别的可靠场景。
该用哪个入口
图片转文字 面向的是印刷体,把它用在粉笔字上会拿到大量空行和错字。要试也应该用手写文字识别,但口径是固定的:工整手写可用,连笔潦草明显下降,务必人工校对。板书的笔迹通常比作业本更奔放 —— 站着写、写得快、还要背对学生,工整度往往低于普通手写笔记。
结构一定会丢
板书的价值在布局:左边是提纲、右边是推导、中间画了箭头把两块连起来。识别输出的是按位置逐行排下来的纯文本,箭头没了、左右两栏会穿插、圈起来的重点和正文混在一起。所以别指望它替你做笔记,它只能帮你把字认出来。
三个拍摄条件,比任何设置都有用
擦干净再拍。 已讲完的推导先擦掉,只留当前一版。残字和重影造成的错行,后期一条都清不出来。
正对板面,别从后排斜着拍。 斜拍会压缩字符宽度。座位偏远时整块黑板在画面里只占很小区域,每个字能分到的像素太少,这比清晰度更致命 —— 密集小字识别不全的门槛解释见 长截图、密集小字识别不全?卡住你的是一条像素密度门槛。分两半拍、每半离近一点,比退后拍整块有效得多。
躲开顶灯反光。 光斑正好落在字上时那一片必然漏识。本站没有去反光、增强、矫正倾斜的功能,只能靠换角度。
更好的两条路
要课件。 老师手上有 PPT 或 PDF 电子版,这是零错误率的来源。能拿到文件就不要拍屏幕,路径见 课件、PPT 上的字怎么提取?能拿到源文件就别识别。
只认关键条目。 真正需要电子化的往往只是标题、定义和公式之外的文字部分。公式本身识别不了(数学公式在无法可靠识别的范围内),公式要么拍照留存,要么手写进文档。
额度上别浪费:一张照片算 1 页,识别不向游客开放,注册(短信验证码登录即完成注册)一次性送 5 点、永久有效,VIP 会员每月另有 20~120 点配额(当月不结转),单次最多 10 张。一整节课十几张板书照片,注册账号后再传更从容。