教程中心

文件转换与处理的实用图文教程,每篇解决一个真实问题

字数统计和 Word 里的数对不上,差在哪

站内字数口径是汉字逐字计、一串连续英文字母算 1,段落按换行数加一,统计范围是文档正文段落;与办公软件状态栏基本一致,对不上的差值多出在标点与文本框是否计入这类口径选择上,不是谁算错了。

阅读全文 →

彩色的图转 CAD,为什么只剩一圈外轮廓?

因为位图描线先把图片按明暗切成黑白两色再沿边界描线,颜色、灰度、透明度与填充全都不保留,彩色块只会留下一圈外轮廓;要得到内部线条,必须先把它变成白底黑线的黑白线稿。

阅读全文 →

XML 转换会不会联网去取外部 DTD?

不会。这一页不联网取外部 DTD,也不做 DTD 与 Schema 校验,更不做 XSLT 转换;能做的是格式化、压缩、校验、转 JSON、提取属性和提取 CDATA 这六个动作,全程在浏览器里完成,文件不离开本机、不占用每日转换次数。

阅读全文 →

ZIP 解压一次能出多少文件,加密包行不行

三条天花板是 1000 个文件、解压后总计 200MB、单个文件 50MB,超出即中止并报大小超限;加密 ZIP 不支持、也不弹密码框,RAR 与 7Z 都不收,每次只处理所选的第一个压缩包,结果平铺输出。

阅读全文 →

一批照片合成 PDF,三步该怎么排

三步是先在相册里把顺序排好、同名同批一次传完、传完立刻核对每页对应哪张照片。顺序一旦错,返工要把整份重新合成一遍,比拍照本身更费时间。站内图片转PDF 逐页对应,一张图出一页。

阅读全文 →

一沓笔记照片怎么变成能用的讲义?先合成再挑

一沓笔记照片做成讲义分三步:先把整沓按顺序合成一份不识别的文档,再按章节挑出真正要数字化的那几页去识别,最后把识别结果并回讲义。全量识别最费工也最难核对。

阅读全文 →

只要其中一页出来,最简单的做法是走哪一步

直接走拆分或提取单页那一步,把要的那一页单独出成一个文件,别整本合并之后再手工删页。动手前先确认你要的是某一页,还是连续某几页,两者的填法完全不同。

阅读全文 →

DXF 里某个点的坐标怎么读出来?查看器的定位办法

查看器读的是文件里真实存着的数值,端点坐标、线段长度和夹角给得出来;面积、体积和图上的标注值给不出,要按坐标自算或回 CAD 里量。

阅读全文 →

多个 PDF 合成一个,最省事的三步是哪三步

合并只需要三步:按最终页序排好提交顺序、一次全部上传、下载后从第一页翻到最后核页码。最容易出问题的不是转换本身,而是文件的先后次序,站内的 PDF合并 会原样保留每个文件各自的页面尺寸与横竖向。

阅读全文 →

手绘草图转 DXF 值不值?重画更快的那几种情况

线条干净、只有轮廓的草图值得转,能省掉描形的活;带尺寸数字、剖面填充和多行文字的草图不值得转,因为识别不做文字也不做分层,剩下的活等于把图重画一遍,直接照着画反而更省事。

阅读全文 →

PDF 里的字整篇拷出来,最简单的做法是哪一步

先花十秒看字能不能选中:能选中的走「提取文本」这一步就够,直接出纯文字;选不中的是图片型扫描件,必须先走识别那一步,两个入口完全不同,走错了怎么等都等不出结果。

阅读全文 →

手写申请表、审批单转 Word 留档:字段和签字分开处理

框格里的字段值走表格那条入口更整齐,落款的签字与印章本来就不该送进识别。正确做法是三份产物:结构化字段表、排版后的正文、原图留档,缺一项日后再查还得重扫一遍。

阅读全文 →