文件转换与处理的实用图文教程,每篇解决一个真实问题
自带识字够用在一屏、几行、当场复制的场合。一旦涉及多页、表格、要导出文件、要在电脑上接着改,它就开始缺东西,需要换成能出文件的识别入口。
整页转了九十度或一百八十度,文字类入口会尝试纠正整页方向后再识别;斜着拍与局部旋转不在纠正范围内,表格类入口不做这件事,要先在相册里把图转正再上传。
「SVG转DXF」把贝塞尔与圆弧拆成折线段,精度数值越小越贴合越平滑、DXF 也越大,两者是同向变化。按用途定档:只为看图别取最小值,要下料再收紧并控制拆分数量。
先降体积、别动边长。传不进去是体积的事,用压缩解决;边长一缩小字就掉。过大的图即使传得进去也会被再压一道才送识别,所以不要自己压到刚好卡线。
报「读不到尺寸」是根节点既没有 viewBox 也没有 width/height,两者至少要有其一才能换算毫米。补法是在导出时写上画布尺寸,或手动加一个与内容范围一致的 viewBox。
两条路是两个入口两种扣点:格子里的字是打印的就走表格识别,是手写的就走手写表格。走错的直接表现是行列全空或整页变成一堆文字,判断只看字是谁写的。
「SVG转DXF」有意跳过文字实体,因为字体与对齐跨软件极易错位,所以 DXF 里没有 TEXT 是设计行为。要么先在矢量软件里把文字转成轮廓再转,要么到 CAD 里重标。
不是随机分配。同一能力固定先走一家供应商,它临时不可用时才切到另一家,所以正常两次走的是同一接口。个别字有出入时以人工核对原图为准,不必反复重跑。
转成 JPG、JPEG、PNG、BMP 或 WEBP 再传。四个图片识别档只收这五种,TIFF 与 GIF 明确不收,站内也没有它们的转格式入口,得在本地看图软件或办公软件里另存为上述格式。
先改填写规矩,而不是先调工具。表格识别只还原行列位置、不做字段抽取,一格写五项就会挤在同一格里;上传前要定死「一行是什么、一列是什么」,让每项各占一格并留出列间隔。
能不能保住版式只看源文件:文字型 PDF 转出来是可编辑文本框加大致位置,扫描图片型只会得到一张铺满幻灯片的图。段落重排、母版配色、 SmartArt 与动画一定丢,需要逐页还原只能照版重做。
只动两三页时先把那几页拆出来单独转,比整本转换后再删页省一半时间,也不会把没改的页一起弄乱。改动超过三分之一、或要套新模板,才值得整本转一遍再收拾版式。