先裁再识。把标题栏区域单独截出来交给 图片转文字,比整张图纸一起上传准确得多;整图里密布的尺寸线、剖面线和代号会被当成干扰字符,结果里全是无意义片段。
一、四步做法
- 截图只留标题栏:图号、名称、材料、比例、重量这几格入镜即可,四周留一点空白。
- 拉高对比度:晒图发灰时先调黑白,让笔画实心。
- 分块识别:字段多的表可以按行分两次截,减少串行。
- 粘进系统前逐字核:图号和材料代号错一位,后续领料和检验全跟着错。
二、哪些字段适合识别
| 字段 | 适合度 | 说明 |
|---|---|---|
| 打印体图号 | 高 | 字形规整,最省心 |
| 材料与表面处理代号 | 中 | 字母数字混排易漏位 |
| 手写签名与日期 | 低 | 走手写入口更合适 |
| 公差与形位符号 | 不适合 | 符号类不保证识别 |
三、成套图纸录入流程
- 先把 PDF 逐页出题,用 PDF转JPG 得到每页一张图,单次页数有上限,见工具页提示。
- 统一裁切位置:同一套图的标题栏在同一角,第一次裁好后照搬尺寸。
- 命名固定为图号,方便后续检索。
- 录入完做去重检查,避免同一图号被两个版本各录一次,可用 文本去重。
四、别做这几件事
- 别整张 A0 图直接上传:分辨率不够时小字本来就糊,还带上大量无关图形。
- 别指望识别出图层与标注关系:它只给文字流,字段归属要人来判。
- 别省略复核:把手写体当印刷体喂进去,出来的结果看起来像真的但数值不对。
常见问题
问:CAD 导出的 DXF 能识别标题栏吗?
答:不能,DXF 属于图形文件,走 CAD 相关能力;识别的输入是图片或文字型 PDF。
问:扫描件 PDF 可以直接读标题栏吗?
答:图片型 PDF 要先转成图片再识别,或用收 PDF 的扫描专用入口。
问:一次能录多少张?
答:每日识别量有上限,超出后次日再试或联系站长。
本站能力与限额说明
站内 图片转文字 从裁好的标题栏图像中提取文字;识别在服务器端完成,服务器装有可匹配的中文字体,特殊字体可能回退,涉密材料请自行评估是否上传。
不解析 DWG,不做字段自动归类也不承诺符号识别;计费按识别额度点数扣减,每页通用 1 点、手写 1 点。
游客与未充值注册用户单文件上限 8MB、每天 5 次成功转换;充值 VIP 会员后单文件上限提高到 20~50MB(随档位递增),转换次数不限,各档当前售价与额度以 会员页 为准。文件处理完保留 24 小时,到期自动清理,成品请当天下载。