拖放 TXT 文件到这里
支持 .txt .log .md .csv .json .xml .ini .srt 等纯文本(最大 20MB)· 也可以直接把文本粘贴到下面的输入框
换行与编码
浏览器的编码器只能输出 UTF-8,无法直接生成 ANSI/GBK 文件;对方系统必须是 GBK 时,用记事本打开下载结果后「另存为 → 编码 ANSI」。
行处理(按勾选顺序执行)
查找替换(作用于整段文本)
需要服务器处理的文档转换
关于在线文档工具
文件真的不上传吗? 这四个工具都是纯浏览器端实现:文件由你的电脑读取、解析、处理并生成下载,页面加载完成后不再有与文件相关的网络请求,断网也能继续用。因此它们不占用每日免费转换次数,也不需要登录,接口密钥、客户名单这类内容可以放心粘进来。需要服务器算力的转换(PDF 转文本、Excel 转 PDF、图片转 CAD)在别的分类里,会如实标注。
编码是怎么识别的? 先按严格 UTF-8 解码,一旦出现非法字节序列就改按 GBK 解——中文文本在 UTF-8 下是三字节一组、在 GBK 下是两字节一组,字节组合规律不同,判错概率很低;纯英文数字的文件两种编码结果完全一样。文件开头有 EF BB BF(BOM)时直接确定为 UTF-8,XML 文件里写了 encoding="GBK" 时按声明走。识别不对可以在下拉框里手动指定。
为什么生成不了 GBK 文件? 浏览器提供的编码器(TextEncoder)只支持 UTF-8,这是浏览器本身的限制。所以输出只有「UTF-8」和「UTF-8 带 BOM」两种。带 BOM 的版本 Excel 双击打开中文不乱码;对方系统必须收 ANSI/GBK 时,用 Windows 记事本打开下载结果再「另存为 → 编码 ANSI」即可。
CSV 乱码和错列是怎么回事? 乱码几乎都是因为文件是 UTF-8 但没有 BOM,Excel 按本地 ANSI 去解,导出带 BOM 的 CSV 就能解决。错列通常是单元格里的逗号、换行没有用双引号包起来;本站解析遵循 RFC4180,引号内的分隔符与换行按内容处理,连续两个引号表示一个引号字符。转 TSV 时会把单元格内的制表符与换行替换成空格,粘进 Excel 不会错位。
JSON 与 XML 互转的约定是什么? XML 的属性和子元素是两种东西,转成 JSON 后都要占一个键,因此约定属性加 @ 前缀、元素文本用 #text,同名兄弟节点合并成数组。反过来 JSON 转 CSV 时嵌套对象会扁平化,键名用 a.b.c 这样的路径,所有对象的键取并集,缺失值留空。命名空间前缀按字面名输出,不解析它的含义;不做 DTD 与 Schema 有效性校验,只判断格式是否合法。
大文件会不会卡死页面? 单文件建议 20MB 以内。内容超过 5000 行或 200KB 时,文本框只显示前 500 行预览(CSV 的表格预览是前 100 行 30 列),处理、统计与下载都按完整内容执行,界面上会标明当前处于预览状态。XML 用自写的事件式解析器逐字符扫描,不建 DOM 树,几 MB 的文件也不会让页面长时间失去响应。
不能处理什么? 二进制格式一律不行:.docx、.xlsx、.pptx、.pdf 都是压缩包形式的文件,拖进来会提示解析失败,请先在 Office 里另存为纯文本或 CSV。同样不支持 UTF-16、Big5、EUC-KR 编码的输入,不支持 JSON5、YAML,也不联网获取外部 DTD 与外部实体。