文件转换与处理的实用图文教程,每篇解决一个真实问题
双击打开 CSV 时程序会先猜每列类型,超过十一位的纯数字自动转成科学计数,开头的零还会直接掉。只有走导入向导把那一列的数据类型指定为文本,长编号与前导零才保得住。
文本版 DXF 把每个坐标都写成明文,同一张图比二进制格式大几倍是常态;瘦身按删无引用的块定义、清理重复图层、降版本三条走,三条做完还大就是图形本身画得太碎。
虚线画成实线多半是线型比例与图形实际尺寸不匹配,单位从英寸换成毫米时差 25.4 倍,一节划间就被画成一整段实线;文件本身只有连续线时怎么调都不出虚线。
A4 打印有页边距硬约束,长图滑动没有页面边界,两套排版逻辑不能共用一份文件。动手前先问这份东西会不会上纸、要不要装订归档:会上纸就按分页那套排;只在手机里传阅时改成一条通栏,锁住宽度、放大字号、去掉页眉页脚与页码。
先改尺寸再压体积:先把画布做成短边 1000 像素以上的方图并用 RGB 255 铺满背景,最后一步才压体积;先压缩会把边缘噪点放大,白底变灰底。
先确定哪一层是可重复数组,再定一行一个对象。选错数组或内外层字段混着取,行数会成倍增减;以全部出现过的键作表头,才不会丢掉增量字段。
靠统一命名把年份、部门、序号写进文件名,再批量整理名称并导出文件清单,目录就自然生成。手工抄录会漏字错号,机器读取文件名不会,前提是命名规则先定死且全年不换。
有效水印含三要素:项目名、接收方、日期,缺一不可。位置选斜向平铺整页而不是角落一行,透明度压到不遮数字又能被复印保留,外发才真正有追溯力。
判据只有一条:在这份 PDF 里能不能选中一行字。能选中走转换档,效果更好且不消耗识别额度;选不中说明整页是一张图,只能用识别类入口处理,而转换档本身不提供 OCR(光学字符识别)。
六个识别入口里只有「手写笔记转Word」图片和 PDF 都收、且可以混在同一次上传里,输出 DOCX;其余入口各收一边,把 PDF 混进图片入口会被直接拒。
印章、数学公式、竖排古文和涂改覆盖的内容都无法可靠识别,站内明确不提供这四类能力,也不做翻译。能认的是印刷体和工整手写;章压住的正文仍可当普通页识别文字部分。
因为传上去的图比你看到的更糊。长边超上限时系统会等比缩小后再识别,WEBP 与体积偏大的图还要先重编码成 JPEG,小字和浅字在这种叠加下越过低限就整段消失;本地再压一次是第三次损失。