这里转换的是 TXT 的字符编码,不是翻译正文,也不是生成 EPUB。请保留原始文件。
较早的中文文本可能使用 GBK、GB2312 或 GB18030。需要在不同编辑器与设备间使用时,可以另存一份 UTF-8。EpuBloom 在浏览器本地读取支持的编码,下载新的文本副本。
四步将中文 TXT 转为 UTF-8
- 打开TXT 转换器,选择原始
.txt文件。 - 在“转换为 EPUB”下方查看“当前 TXT 编码”。旧版中文文件可能显示“GBK / GB18030(推测)”。
- 在“转换为”中选择 UTF-8,点击转换编码。
- 打开下载的
.utf8.txt副本,对照原文件检查书名、多个段落、标点和末尾内容。
副本沿用“导出文件名”。例如名称填写“阅读笔记”,会得到 阅读笔记.utf8.txt。编码转换会直接下载 TXT,不会覆盖已经生成的 EPUB 转换结果。
编码转换到底改变了什么?
正常情况下,文字不变,保存文字的字节发生变化。以中文二字为例,十六进制字节如下:
| 编码 | “中文”的字节 |
|---|---|
| GBK | D6 D0 CE C4 |
| UTF-8 | E4 B8 AD E6 96 87 |
把 书籍.txt 重命名为 书籍.utf8.txt 只改文件名,不会转换编码。转换按钮会先读取字符,再写入目标字节。UTF-8 副本不带 BOM;UTF-16 LE / BE 副本会带 BOM。
为什么当前编码显示“推测”?
工具优先识别 UTF-8、UTF-16 的 BOM,然后严格验证 UTF-8,最后尝试 GB18030。GBK 与 GB2312 的字节也可能符合 GB18030,因此没有 BOM 时无法可靠细分这几种编码。即使字节可以解码,也不代表每个字符一定符合原作者的意图。
如果来源是 Big5、Shift-JIS 等其他编码,请先用能指定读取编码的编辑器处理,本工具没有提供这些目标编码。乱码排查指南说明了“重新打开原始字节”与“保存已经乱码的文字”的区别。
UTF-8 能反向转为 GBK 吗?
可以,目标编码选择 GBK 即可。但 GBK 无法表示一些字符,例如许多 emoji。遇到这种情况,工具会停止下载,不会静默替换;可改选 UTF-8 或 GB18030。下载成功后仍应核对实际内容。
哪些乱码无法通过转换恢复?
如果此前保存时已经把缺失字符变成 ? 或 �,编码转换无法还原原文,需要找未修改的备份。若工具提示无法读取,请先确认来源编码,不要反复保存乱码副本。
下一步:制作可阅读的电子书
文字正确后,可以按照TXT 转 EPUB 指南制作电子书,并参考章节标题示例生成可跳转目录。单独转换编码不会增加目录、书籍信息或封面。