文本文件打开是乱码:怎么读
打开一个 .txt,看到的不是正文,而是“浣犲ソ”或一排排 �。文件并没有损坏:只是程序用错了编码来读。下面说明原因以及如何读出文字。
阅读约 4 分钟更新于 2026年10月8日
为什么会这样
计算机以字节保存文本,编码就是把字节转换成文字的对照表。如今几乎一切都使用 UTF-8:网站、Mac、Linux、Android,以及新版 Windows 的记事本。较旧的中文文件常用 GBK(简体)或 Big5(繁体)。
用一种编码写入的文件如果用另一种编码读取,文字就会变成别的字符。文本本身完好无损,只需要正确地读取。
乱码说明了什么
浣犲ソ— 看似汉字却毫无意义:文件是 UTF-8,却被当成 GBK 读取。�����— 带问号的菱形:文件是 GBK 等旧编码,却被当成 UTF-8 读取。
1. 在 OsonKit 中打开文件
把文件拖到 OsonKit 上。编码根据字节本身判断:文件开头的标记(BOM)表示 UTF-8 或 UTF-16;能无错误地按 UTF-8 解码的文本就是 UTF-8。所选编码会显示在文件旁边。文件在浏览器中读取,不会发送到任何地方。
- 文件最大 10 MB。
- 支持的编码:UTF-8、UTF-16(带 BOM)、Windows-1251 和 Windows-1252。不支持 GBK、GB2312 和 Big5,这类文件无法正确显示。
- 这是查看器:可以阅读和复制文本,但不能编辑。
2. 把文本重新保存为 UTF-8
如果要把文件转给别人,请保存成在哪里都能打开的格式。从 OsonKit 复制文本,粘贴到记事本的新文档并保存。GBK 文件可以在中文版 Windows 上直接用记事本打开,它会按 ANSI 正确读取。Windows 10(2019 年起)和 Windows 11 的记事本默认保存为 UTF-8,所有现代程序和手机都能识别。
如果乱码出现在 CSV 中
.csv 也一样:以 UTF-8 导出的 CSV 在 Excel 中打开时,中文可能变成乱码。CSV 查看器用与文本相同的方式判断编码,并以正常文字显示表格。
如何避免乱码 用 UTF-8 保存和发送文本。这是通用标准:文件在 Windows、Mac 和手机上打开效果一致。
现在就读取文件
把 .txt 拖到这里。编码会自动识别,文件不会离开你的设备。