先看打开方式这一项,别看识别结果。「图片转文字」给出的是 UTF-8 纯文本,本身没坏;是老编辑器默认按本地那套编码去解,字才花的。换对编码再判第二步,别急着重拍重识别。
一、花的是什么样:三种现象各对应一件事
| 现象 | 多半是哪件事 | 先做什么 |
|---|---|---|
| 整页方块与问号 | 打开时编码选错 | 换 UTF-8 重新打开一次 |
| 中文正常标点变怪 | 编码接近但不完全对 | 用「TXT处理」规整再看 |
| 中文正常个别字错 | 图糊或小字漏识 | 回原图核对这一处 |
只有第三行才是识别的事。前两行属于打开环节,重跑识别既白花额度又解决不了问题。
二、判断顺序:三步走完再决定动不动内容
- 在编辑器里找当前文件的编码提示,通常在窗口底部。
- 看到非 UTF-8 的字样,就用「以 UTF-8 打开」这个选项重开一次,不要覆盖保存。
- 没有能改编码的编辑器,就把文本贴进网页输入框,用「TXT处理」看一眼显示是否正常。
一句话记法:能看见对的字,就是打开方式的事。
三、确实需要换编码的情况
- 要把这份文本喂给只认本地老编码的老系统导入。
- 收文一方明确要求附带某种编码,且对方不会自己调整。
这时才真的转一道:先确认内容无误,再另存为对方要的编码,原始那份留着不动,方便日后核对。
四、别把乱码当成识别错误重来一遍
- 直接重拍重识别:编码不会因此改变,白花一份额度,还丢了可对比的两份结果。
- 反复另存到看不出问题:每存一次都可能被编辑器的默认编码改写一次,越救越花。
- 拿截图当成品:截图不能检索也不能改字,只是把问题往后推。
扫描件同理:走「扫描件PDF转Word」拿到的是文档格式,字体缺字和编码不是一回事。
常见问题
问:手机上打开也花怎么办?
答:手机查看器多数默认按 UTF-8 读,若仍显花,换成浏览器里的文本工具看一次即可判定。
问:能不能多传几张拼成一个文件?
答:输出按原图同名逐张给,不会自动拼接,合并要自己做。
问:下载后还能改吗?
答:文本归你处置,服务器只做识别与产物清理,不承诺识别率,也不替你校对内容。
本站能力与限额说明
站内 图片转文字 的做法是上传图片、由服务器抽取文字并给出 UTF-8 纯文本;转换在服务器端完成,服务器装有可匹配的中文字体,特殊字体可能回退,涉密材料请自行评估是否上传。
这项服务不收 PDF,也不做翻译、不做内容润色与总结,识别效果受清晰度影响,本站不承诺识别率。
每一次识别都要向云服务商付费,所以游客不开放识别,注册后即可使用;注册时一次性赠送的识别额度永久有效,VIP 会员每月另有配额;一页扣几点按能力不同(通用文字与手写文字 1 点、表格 2 点、手写表格 3 点),每日识别量有上限,超出后次日再试或联系站长。识别按额度点数计、不按次数计,单文件上限 8MB,会员随档位提高到 20~50MB,售价与额度以 会员页 为准;文件处理完保留 24 小时,到期自动清理,成品请当天下载。