在线工具

工具箱 › 转换 › 编码转换

字符集编码解码

在线按指定编码解码文本文件,修复 GBK、Big5 与 UTF-8 混淆导致的乱码,并统计无法解码的字节数以判断编码是否选对。解码在浏览器内完成。

点击选择文件,或直接拖进来 解码在浏览器内完成,文件不会上传

乱码是怎么产生的

中文网页和文本文件常用 GBK 或 Big5,而现代系统默认 UTF-8。用错编码打开就会出现「锟斤拷」或「��」这类乱码。

本工具按你指定的编码把字节解码成文本,再按目标编码写回去。乱码多半是「用 UTF-8 的内容按 GBK 解」造成的,所以第一步先确认原文到底是哪种编码。

为什么有「无法解码字节」这个计数

选错编码时,有些字节序列不构成合法字符,会被替换成 U+FFFD。这个数字大于 0 就说明选错了编码 —— 转换结果会丢内容,不能直接用。

为什么只能导出 UTF-8

浏览器内置的 TextEncoder 只会生成 UTF-8 字节,没有 GBK 与 Big5 的编码器。要输出 GBK 得把整套编码表(约 2 MB)塞进页面,与本站「不加载外部资源、体积尽量小」的原则冲突。

实际场景里把文件读成正确文本再存为 UTF-8 就解决问题了:UTF-8 是通用编码,现在的编辑器与系统都认。

常见问题

怎么知道自己的文件是什么编码

中文 Windows 记事本存的 txt 多为 GBK,macOS 与 Linux 文本编辑器存的通常是 UTF-8。实在不确定可以先按 GBK 试,看「无法解码字节」是否为 0。

能处理二进制文件吗

不能。图片、压缩包这类二进制内容按文本解码只会得到乱码,请只用于文本文件。

我确实需要 GBK 字节文件

本工具做不到。可以先用它确认原文编码,再用系统自带的 iconv 命令行转码,那边的编码表是完整的。