Neatbo.

把 TXT 做成好读的 EPUB:编码、章节与目录结构

导出长文为 EPUB 前先规划章节。排查乱码、章节误识别与目录跳转错误,用结构检查清单改善实际阅读体验。

连续的文字,还不是一本好读的书

长文放进 EPUB 容器后,读者仍然需要知道自己读到哪里,以及怎样跳到下一章。对小说、访谈集或长篇笔记来说,可用的目录比装饰性封面更直接地影响阅读。

制作前先看原稿:章节标题是否独立成行、同一级标题是否使用一致格式、前言与附录是否也需要成为目录项。结构越明确,后面的章节识别越容易核对。

先解决乱码,再处理排版

如果源文本已经显示乱码,继续清理空格或转换 EPUB 只会把问题带到下一步。应回到原始文件确认编码,在能正确阅读正文后再进行其他处理。

清理空白也需要克制。连续空行可能是多余的,也可能用于区分场景;诗歌、列表与代码的缩进可能有意义。不要为了让文本看起来紧凑,把这些结构一起删除。

章节规则必须经过人工检查

自动识别依赖标题模式,不能理解每一处章节意图。类似章节标题的正文句子可能被误识别,写法不一致的真实标题也可能漏掉。

在章节编辑器中核对目录名称和起始正文,特别是第一章、短章节和附录。确认无误后再生成文件,比在阅读器里发现目录跳到错误位置更省时间。

用阅读器验收阅读体验

打开生成的 EPUB,测试目录跳转,并检查中文标点、段落分隔和较长标题。字体、分页和行距可能随阅读器变化,不应把浏览器预览当作所有设备上的固定版式。

保留 TXT 原稿与章节设置记录。以后修订内容时,从清晰的来源重新生成,比在多个导出副本之间判断哪个版本最新更可靠。

用章节地图检查整份原稿

转换前,先列一份包含前言、主要章节和附录的简短地图,为每项找到真正的开头段落。这样可以发现一个容易忽略的问题:原稿前面的目录列表可能重复了全部标题,却并不是这些章节的真实位置。

章节层级应该表达从属关系。每个小节都设为顶级,目录会显得嘈杂;全部嵌套到第一章下面,又会让后续内容难以发现。应有意识地使用编辑器提供的层级,并确认导出顺序。

源稿修改后,导航也属于修订内容。新增前言会移动位置,重命名标题可能改变先前识别的模式。应重新识别并抽查边界,不能因为第一次导出成功,就认定后续版本都正确。

用章节地图检查整份原稿
源稿特征编辑决定阅读器检查
前言加入目录还是作为引入打开位置符合预期
章节标题每个边界对应真实标题链接打开正文而非目录列表
短小节选择有意义的层级目录仍然便于浏览
附录需要查阅时加入导航最后一个链接与阅读顺序

完成前的检查清单

  • 在编码试读里检查标点和生僻字。
  • 保留有意义的空行、诗歌分行与缩进。
  • 测试开头、中间和最后的章节链接。
  • 保留源稿并记录章节选择,便于后续修订。

参考资料

  • W3C:EPUB 3.3

    用于了解 EPUB 出版物结构与导航;不同阅读器的排版和功能支持可能不同。

本文相关工具

TXT 编码转 UTF-8 →选对文字编码,另存一份正常显示的 TXT。清理空格与空行 →清理多余空格和空行,保留需要的段落。TXT 转 EPUB →给文字加上封面和目录,读着更舒服。打开 EPUB →在浏览器打开本地 EPUB,检查章节内容。