点击选择文件,或直接拖进来
解码在浏览器内完成,文件不会上传
—文件体积
—判定结果
0无法解码字节
—原文预览
乱码是怎么产生的
中文网页和文本文件常用 GBK 或 Big5,而现代系统默认 UTF-8。用错编码打开就会出现「锟斤拷」或「��」这类乱码。
本工具按你指定的编码把字节解码成文本,再按目标编码写回去。乱码多半是「用 UTF-8 的内容按 GBK 解」造成的,所以第一步先确认原文到底是哪种编码。
为什么有「无法解码字节」这个计数
选错编码时,有些字节序列不构成合法字符,会被替换成 U+FFFD。这个数字大于 0 就说明选错了编码 —— 转换结果会丢内容,不能直接用。
为什么只能导出 UTF-8
浏览器内置的 TextEncoder 只会生成 UTF-8 字节,没有 GBK 与 Big5 的编码器。要输出 GBK 得把整套编码表(约 2 MB)塞进页面,与本站「不加载外部资源、体积尽量小」的原则冲突。
实际场景里把文件读成正确文本再存为 UTF-8 就解决问题了:UTF-8 是通用编码,现在的编辑器与系统都认。
常见问题
怎么知道自己的文件是什么编码
中文 Windows 记事本存的 txt 多为 GBK,macOS 与 Linux 文本编辑器存的通常是 UTF-8。实在不确定可以先按 GBK 试,看「无法解码字节」是否为 0。
能处理二进制文件吗
不能。图片、压缩包这类二进制内容按文本解码只会得到乱码,请只用于文本文件。
我确实需要 GBK 字节文件
本工具做不到。可以先用它确认原文编码,再用系统自带的 iconv 命令行转码,那边的编码表是完整的。