TXT 转 EPUB:编码、章节识别与目录检查
从 TXT 编码试读开始,整理独立章节标题、编辑目录并导出 EPUB。附两章示例与阅读器检查清单,避免乱码和错误章节链接。
先检查编码预览
选择纯文本文件,再选择 UTF-8、GB18030 或 Big5,并阅读预览。严格 UTF-8 校验不等于万能编码识别;确认文字正常后再继续。粘贴的文本已经是 Unicode。
检查章节起始行
可以输入“第一章 到达”、一段正文,再输入“第二章 回家”和另一段正文。识别章节后,检查行号、层级并编辑标题。手动章节必须按行号顺序排列,并指向实际存在的行。
导出后重新打开
填写书名、作者与语言,可选 JPEG 或 PNG 封面。导出 EPUB 后,在 EPUB 阅读器里重新打开,分别点击章节,确认正文可以选择。输出是 EPUB 3,而不是页面截图集合。
先用两章样稿验证目录
每个标题独占一行。识别章节后,检查正文开头是否属于其上方的标题;对话中的章节名称、原稿自带的目录页,都可能被误当成正文的章节起点。
修订时,把原始 TXT 与章节设置一起保留。导出 EPUB 的导航对应的是当时那份文字;后续增加行或修改标题后,应重新检查位置,不能直接沿用旧行号。
| 检查点 | 期望结果 | 不符合时 |
|---|---|---|
| 编码试读 | 名称和标点正常 | 改用与源文件相符的编码 |
| 章节编辑 | 两处标题在预期行 | 修正标题位置 |
| 阅读顺序 | 第一章在第二章之前 | 检查正文与章节顺序 |
| 目录导航 | 两个链接均打开对应正文 | 修正后重新生成 |
第一章 抵达
清晨,小林来到车站。
第二章 归家
窗前的灯仍然亮着。完成前的检查清单
- 确认导出书籍中的正文可选择。
- 检查长标题和最后一章。
- 在实际阅读器里检查段落分隔。
- 保留源稿,不把导出的 EPUB 当成唯一可编辑原稿。
参考资料
- W3C:EPUB 3.3
用于了解 EPUB 出版物结构与导航;不同阅读器的排版和功能支持可能不同。