课件是识别场景里最特殊的一类:它几乎总是有源文件。所以第一步不是拍照,是问一句能不能要文件。
有文件时,一条识别都不该用
拿到 PPT 或 PDF 后,走 PPT转PDF 再用 PDF 转文本 取字,或者直接在自己电脑上全选复制。这条链路取出的是文件里已有的字符,不经过图像识别,不会产生认错的字符;而拍照识别不管多清晰都要人工校对。只有对方只给了纸质讲义或投影幕布,才往下走。
只能拍时,四类内容会出问题
大标题的艺术字。 PPT 正文用常规字体识别很稳,但标题常做变形、描边、渐变和立体效果 —— 装饰性字体不在可靠范围内,标题反而比正文更容易错。以页面上小字号正文是否清晰来判断一张照片能不能用,方向是反的。
图表与 SmartArt 里的文字。 图内标签位置分散、有连线和小箭头,识别只会按位置逐行列出,看不出「这个词属于哪根柱子」。图表结构要靠你自己补。
分栏排版。 左右两栏的课件,输出时两栏会穿插。补救方式是裁剪成两半分别识别:图片裁剪填起始坐标与宽高,一次最多 15 个文件,走普通转换次数(游客与未充值用户每天 5 次)。代价是半页也算 1 页额度。
半透明色块与动画中间态。 逐帧显示的课件,拍到一半的文字一定漏识。
屏幕和投影是两回事
拍投影幕布的问题是不均匀亮度和色偏;拍显示器(包括用手机拍电脑屏)会出现摩尔纹条纹。本站没有去条纹、去色偏、增强对比度的功能,靠近正对、降低屏幕亮度到不刺眼、避开环境反光是唯一有效的办法。
页数怎么算
一张照片算 1 页,一次最多 10 张。一节课 30 页课件要分三次传,注册后一次性送 5 点、永久有效,VIP 会员每月另有 20~120 点。只是临时用一次的话,体验包 100 页 12.9 元、常用包 500 页 49.9 元,页数永久有效、不会过期。
识别完的输出是每张图片一个同名 TXT。多页拼成一份笔记的整理顺序,见 图片里的字变成文本之后能干什么?整理、检索、汇总四条接续流程。