阅读与转换

将 GBK 转为 UTF-8,保留原来的文字。

开始转换 TXT 编码 ↗全部转换指南 ↗

由 EpuBloom 编写

这里转换的是 TXT 的字符编码,不是翻译正文,也不是生成 EPUB。请保留原始文件。

较早的中文文本可能使用 GBK、GB2312 或 GB18030。需要在不同编辑器与设备间使用时,可以另存一份 UTF-8。EpuBloom 在浏览器本地读取支持的编码,下载新的文本副本。

四步将中文 TXT 转为 UTF-8

  1. 打开TXT 转换器,选择原始 .txt 文件。
  2. 在“转换为 EPUB”下方查看“当前 TXT 编码”。旧版中文文件可能显示“GBK / GB18030(推测)”。
  3. 在“转换为”中选择 UTF-8,点击转换编码。
  4. 打开下载的 .utf8.txt 副本,对照原文件检查书名、多个段落、标点和末尾内容。

副本沿用“导出文件名”。例如名称填写“阅读笔记”,会得到 阅读笔记.utf8.txt。编码转换会直接下载 TXT,不会覆盖已经生成的 EPUB 转换结果。

编码转换到底改变了什么?

正常情况下,文字不变,保存文字的字节发生变化。以中文二字为例,十六进制字节如下:

编码“中文”的字节
GBKD6 D0 CE C4
UTF-8E4 B8 AD E6 96 87

把 书籍.txt 重命名为 书籍.utf8.txt 只改文件名,不会转换编码。转换按钮会先读取字符,再写入目标字节。UTF-8 副本不带 BOM;UTF-16 LE / BE 副本会带 BOM。

为什么当前编码显示“推测”?

工具优先识别 UTF-8、UTF-16 的 BOM,然后严格验证 UTF-8,最后尝试 GB18030。GBK 与 GB2312 的字节也可能符合 GB18030,因此没有 BOM 时无法可靠细分这几种编码。即使字节可以解码,也不代表每个字符一定符合原作者的意图。

如果来源是 Big5、Shift-JIS 等其他编码,请先用能指定读取编码的编辑器处理,本工具没有提供这些目标编码。乱码排查指南说明了“重新打开原始字节”与“保存已经乱码的文字”的区别。

UTF-8 能反向转为 GBK 吗?

可以,目标编码选择 GBK 即可。但 GBK 无法表示一些字符,例如许多 emoji。遇到这种情况,工具会停止下载,不会静默替换;可改选 UTF-8 或 GB18030。下载成功后仍应核对实际内容。

哪些乱码无法通过转换恢复?

如果此前保存时已经把缺失字符变成 ? 或 �,编码转换无法还原原文,需要找未修改的备份。若工具提示无法读取,请先确认来源编码,不要反复保存乱码副本。

下一步:制作可阅读的电子书

文字正确后,可以按照TXT 转 EPUB 指南制作电子书,并参考章节标题示例生成可跳转目录。单独转换编码不会增加目录、书籍信息或封面。