先看打开方式这一项,别看识别结果。「图片转文字」给出的是 UTF-8 纯文本,本身没坏;是老编辑器默认按本地那套编码去解,字才花的。换对编码再判第二步,别急着重拍重识别。

一、花的是什么样:三种现象各对应一件事

现象多半是哪件事先做什么
整页方块与问号打开时编码选错换 UTF-8 重新打开一次
中文正常标点变怪编码接近但不完全对用「TXT处理」规整再看
中文正常个别字错图糊或小字漏识回原图核对这一处

只有第三行才是识别的事。前两行属于打开环节,重跑识别既白花额度又解决不了问题。

二、判断顺序:三步走完再决定动不动内容

  1. 在编辑器里找当前文件的编码提示,通常在窗口底部。
  2. 看到非 UTF-8 的字样,就用「以 UTF-8 打开」这个选项重开一次,不要覆盖保存。
  3. 没有能改编码的编辑器,就把文本贴进网页输入框,用「TXT处理」看一眼显示是否正常。

一句话记法:能看见对的字,就是打开方式的事。

三、确实需要换编码的情况

  • 要把这份文本喂给只认本地老编码的老系统导入。
  • 收文一方明确要求附带某种编码,且对方不会自己调整。

这时才真的转一道:先确认内容无误,再另存为对方要的编码,原始那份留着不动,方便日后核对。

四、别把乱码当成识别错误重来一遍

  • 直接重拍重识别:编码不会因此改变,白花一份额度,还丢了可对比的两份结果。
  • 反复另存到看不出问题:每存一次都可能被编辑器的默认编码改写一次,越救越花。
  • 拿截图当成品:截图不能检索也不能改字,只是把问题往后推。

扫描件同理:走「扫描件PDF转Word」拿到的是文档格式,字体缺字和编码不是一回事。

常见问题

问:手机上打开也花怎么办?
答:手机查看器多数默认按 UTF-8 读,若仍显花,换成浏览器里的文本工具看一次即可判定。

问:能不能多传几张拼成一个文件?
答:输出按原图同名逐张给,不会自动拼接,合并要自己做。

问:下载后还能改吗?
答:文本归你处置,服务器只做识别与产物清理,不承诺识别率,也不替你校对内容。

本站能力与限额说明

站内 图片转文字 的做法是上传图片、由服务器抽取文字并给出 UTF-8 纯文本;转换在服务器端完成,服务器装有可匹配的中文字体,特殊字体可能回退,涉密材料请自行评估是否上传。

这项服务不收 PDF,也不做翻译、不做内容润色与总结,识别效果受清晰度影响,本站不承诺识别率。

每一次识别都要向云服务商付费,所以游客不开放识别,注册后即可使用;注册时一次性赠送的识别额度永久有效,VIP 会员每月另有配额;一页扣几点按能力不同(通用文字与手写文字 1 点、表格 2 点、手写表格 3 点),每日识别量有上限,超出后次日再试或联系站长。识别按额度点数计、不按次数计,单文件上限 8MB,会员随档位提高到 20~50MB,售价与额度以 会员页 为准;文件处理完保留 24 小时,到期自动清理,成品请当天下载。