文件转换与处理的实用图文教程,每篇解决一个真实问题
单据类表格的难点是单号、数量、单位三类列的性质不同。本文给出拍照要求、逐张识别的命名规则和入库前必须做的三项校验。
给 Word 还是给 PDF 取决于对方拿它做什么。只看不改给定版 PDF,要继续编辑给源文件并说明字体,印刷按印厂要求,最稳组合是两份一起给并标注以哪份为准
回收站里的文件几乎百分百能还原;Shift 永久删除后,成功率取决于存储介质和后续写入量。机械盘最有机会,SSD 因 TRIM 通常不可恢复,U 盘和存储卡要立刻停止写入。本文给出“删除后 5 分钟该做什么”的判断树。
扫描出的 PDF 总带几张空白页、旧版本作废页混在里面?教你免费在线删除指定页面,处理完再发人干净利落。
群里收到来路不明的二维码,不敢直接扫?教你免费在线识别二维码内容,先看链接再决定扫不扫,防钓鱼。
连笔与草书是手写识别公认的薄弱区,厂商没有公布相关数据。本文给出放大拍摄、拆行拍摄、增强对比、挑页试跑、混合分工五个办法,以及何时应当放弃识别。
CSV 是纯文本、Excel 是工作簿,两者的能力差异决定了公式、格式、多工作表在 CSV 里根本不存在。本文按六个维度对比,并给出选错格式导致数据丢失的典型场景与解法。
纯前端的CSV转换只处理分隔符文本,不收 XLSX 与 XLS 二进制表格。这条限制只属于这一个工具,站内的办公类工具照样能处理 Excel 文件,两者不要混为一谈。
分隔符识别只看表头行里各候选符号的出现次数,所以表头不规范时就会判错。本文给出四种分隔符的来源、判错的表现和手动指定的正确做法。
CSV转换支持勾选保留哪些列并调整先后顺序,表头还能按三种格式导出。表格预览只显示前 100 行与 30 列,但下载始终按完整数据执行,这个差别必须先知道。
CSV 乱码的原因是文件编码与打开时的解释方式不一致。本文用记事本三步定位真实编码,并给出 Excel 按导入向导正确读取的做法,避免修改后二次损坏。
同一份 UTF-8 的 CSV,Excel 双击打开需要开头有 BOM 才不乱码,程序读取时 BOM 又会污染第一个表头。判断只看一件事:文件交给谁处理。