跳到主要内容
忆云竹

文本文件编码转换

读取 GBK、Big5、日文等旧编码文本,预览后转为 UTF-8 或 UTF-16,并设置 BOM 与换行符。

选择文本文件,或拖到这里。

输出编码
换行符

单文件不超过 10 MiB。旧文件出现乱码时,请选择原编码。遇到无效字节会停止转换,不会悄悄替换字符。

转换结果预览

预览前 20,000 个字符,下载保留完整内容;输出不超过 40 MiB。

内容只在当前浏览器中处理,不上传或保存。

工具介绍

打开显示乱码的旧 CSV 或文本导出时,可选择原编码,再核对转换预览。

使用说明

选择文本文件后自动检查 UTF-8 / UTF-16 BOM;没有 BOM 时严格按 UTF-8 读取。GB18030 / GBK、Big5、Shift_JIS、EUC-JP、EUC-KR、Windows-1251、Windows-1252 文件需手动选择原编码,不能仅凭字节合法就可靠判断编码。

输出支持 UTF-8、UTF-16 LE / BE,可添加 BOM,保留或统一为 LF、CRLF、CR 换行。供 Excel 打开的 CSV 可考虑 UTF-8 加 BOM;这里转换的是文件字节,不会调整表格结构。每次修改编码都会重新读取原文件。

下载前检查预览是否正常。无效字节、二进制控制字符和 BOM 冲突会停止转换,不会静默替换字符;已经保存丢失的字符或问号不能靠改编码恢复。单文件 10 MiB、结果 40 MiB;预览前 20,000 字符,下载完整内容。任务 60 秒超时,可取消,文件不上传、不保存。

常见问题

总能自动识别原始编码吗?

不能。自动模式识别 UTF-8、UTF-16 的 BOM,或接受合法 UTF-8;旧编码需手动指定,已丢失并变成问号的字符无法靠转换还原。

乱码时应该加 BOM,还是切换换行符?

应先选对原文件编码,确认预览中的文字正确。BOM 用于标识输出编码,LF、CRLF 等选项改变的是换行符,都不能代替正确解码;请按接收软件的要求选择。预览只展示前 20,000 个字符,下载保留完整转换结果。

评论

0
后参与评论。
暂无评论
回复讨论

按时间查看完整回复脉络;每条回复都会标明它回应的具体内容。