把 TXT 做成好读的 EPUB:编码、章节与目录结构
导出长文为 EPUB 前先规划章节。排查乱码、章节误识别与目录跳转错误,用结构检查清单改善实际阅读体验。
连续的文字,还不是一本好读的书
长文放进 EPUB 容器后,读者仍然需要知道自己读到哪里,以及怎样跳到下一章。对小说、访谈集或长篇笔记来说,可用的目录比装饰性封面更直接地影响阅读。
制作前先看原稿:章节标题是否独立成行、同一级标题是否使用一致格式、前言与附录是否也需要成为目录项。结构越明确,后面的章节识别越容易核对。
先解决乱码,再处理排版
如果源文本已经显示乱码,继续清理空格或转换 EPUB 只会把问题带到下一步。应回到原始文件确认编码,在能正确阅读正文后再进行其他处理。
清理空白也需要克制。连续空行可能是多余的,也可能用于区分场景;诗歌、列表与代码的缩进可能有意义。不要为了让文本看起来紧凑,把这些结构一起删除。
章节规则必须经过人工检查
自动识别依赖标题模式,不能理解每一处章节意图。类似章节标题的正文句子可能被误识别,写法不一致的真实标题也可能漏掉。
在章节编辑器中核对目录名称和起始正文,特别是第一章、短章节和附录。确认无误后再生成文件,比在阅读器里发现目录跳到错误位置更省时间。
用阅读器验收阅读体验
打开生成的 EPUB,测试目录跳转,并检查中文标点、段落分隔和较长标题。字体、分页和行距可能随阅读器变化,不应把浏览器预览当作所有设备上的固定版式。
保留 TXT 原稿与章节设置记录。以后修订内容时,从清晰的来源重新生成,比在多个导出副本之间判断哪个版本最新更可靠。
用章节地图检查整份原稿
转换前,先列一份包含前言、主要章节和附录的简短地图,为每项找到真正的开头段落。这样可以发现一个容易忽略的问题:原稿前面的目录列表可能重复了全部标题,却并不是这些章节的真实位置。
章节层级应该表达从属关系。每个小节都设为顶级,目录会显得嘈杂;全部嵌套到第一章下面,又会让后续内容难以发现。应有意识地使用编辑器提供的层级,并确认导出顺序。
源稿修改后,导航也属于修订内容。新增前言会移动位置,重命名标题可能改变先前识别的模式。应重新识别并抽查边界,不能因为第一次导出成功,就认定后续版本都正确。
| 源稿特征 | 编辑决定 | 阅读器检查 |
|---|---|---|
| 前言 | 加入目录还是作为引入 | 打开位置符合预期 |
| 章节标题 | 每个边界对应真实标题 | 链接打开正文而非目录列表 |
| 短小节 | 选择有意义的层级 | 目录仍然便于浏览 |
| 附录 | 需要查阅时加入导航 | 最后一个链接与阅读顺序 |
完成前的检查清单
- 在编码试读里检查标点和生僻字。
- 保留有意义的空行、诗歌分行与缩进。
- 测试开头、中间和最后的章节链接。
- 保留源稿并记录章节选择,便于后续修订。
参考资料
- W3C:EPUB 3.3
用于了解 EPUB 出版物结构与导航;不同阅读器的排版和功能支持可能不同。