Markdown/DOCX → EPUB
网文小说怎么从 Markdown/DOCX 转成 EPUB:先讲清两种格式各自是什么,再说明会丢什么、有哪些坑、长篇的章节与编码要特别注意什么,最后给出该用的工具与自检清单。
Markdown/DOCX 是什么
这里把 Markdown(.md)与 Word 文档(.docx)归为一族,因为它们在转换中的角色相同:都是「带轻量结构的写作源文件」。Markdown 是纯文本加标记符号(# 标题、** 加粗),干净但表达力有限;.docx 是一个 ZIP 包,里面是 Office Open XML,排版信息远比 Markdown 丰富(分页、页眉页脚、批注、修订)。两者都适合作为转换的起点,而不是最终的阅读格式。
.md.docxEPUB 是什么
EPUB 是国际数字出版论坛制定的开放电子书标准,本质是一个 ZIP 压缩包,里面装着 XHTML 正文、CSS 样式、图片和一份定义阅读顺序的 OPF 清单。它最大的特点是「可重排」:正文与排版分离,阅读器会根据屏幕大小和字号重新排版,因此同一个文件在手机、平板、电脑上都能得到合适的版面,是除 Kindle 生态外最通用的电子书格式。
.epubMarkdown/DOCX 转 EPUB 需要注意什么
先从源格式抽出内容时
.docx 是 ZIP 包里的 Office Open XML,正文在 word/document.xml。其中样式(标题级别)决定章节能否被识别:如果作者用的是「手动加粗的大字」而不是「标题 1」样式,转出的 EPUB 就不会有目录。Markdown 侧则要注意它不支持复杂的表格与嵌套结构。
写进目标格式时
EPUB 不是「压缩一下就行」:它必须包含 mimetype(且必须是第一个条目、不压缩)、META-INF/container.xml、内容 OPF 与 nav 目录,缺一项阅读器就会报「文件损坏」。所以转 EPUB 优先用成熟的转换器,不要手工拼 ZIP。
两端格式交互带来的坑
- 源文件的章节只是普通文字行,而目标格式要求一份真正的目录。转换器会尝试用正则识别「第X章」「Chapter N」这类模式 —— 识别不准就会出现目录条目错乱或整本书只有一个章节。转换后请检查目录条目数与实际章数是否一致。
会丢什么
- 两端结构相近,主要损失是排版细节的细微差异
会得到什么
- 真正的目录与章节跳转
- 主流阅读器与书库的完整支持
转换后自检清单
- 先用前 3 章试转,确认没有丢字、串行或错位,再整本转换。
- 检查章节切分:目录条目数应与实际章数一致。
- 随机翻 5 处,搜索书中一个人名,确认文本可被完整检索。
- 确认插图数量与位置:尤其看图片有没有挤在章节末尾。
- 补全书名、作者、语言;语言标签写错会导致排版(如中文断行)异常。
- 用两个不同阅读器各打开一次,确认目录与封面正常 —— EPUB 对结构要求最严。
小说转换的特殊之处
小说是最常见、也最特殊的一类电子书:几百上千章、几乎没有图表、常常只有一份 TXT 源文件,中文源还经常带防盗乱码。下面几点是最容易踩、也最影响阅读体验的。
- 长篇小说动辄数百上千章,目录质量直接决定这本书能不能用。转换前先把章标题统一成一种可识别的写法(例如都写成「第X章 标题」并独占一行),否则目标格式里的目录会缺章、串章,甚至整本只剩一章。
- 分卷信息(「第一卷」「第二卷」)在多数转换里会被降级成普通标题,卷与章的层级关系随之丢失。如果你在意层级,转换后到编辑器里把卷标题提升一级,别让它和章标题平级。
Markdown/DOCX 转 EPUB 的工具
下面这些工具都能完成这个方向的转换,按你的操作系统和文件数量挑一个即可。动手前建议先看上一节的注意事项 —— 顺序错了(比如该先 OCR 却直接转)往往要重来一遍。
Sigil
免费桌面应用专做 EPUB 的可视化编辑器,能直接改内部 XHTML/CSS、修目录、补元数据。适合「EPUB 转出来后需要精修」的场景 —— 比如章节切错了、封面没进去、排版要调。它不做格式转换,只做 EPUB 的编辑。
Calibre
免费桌面应用电子书转换的事实标准,免费开源。支持 EPUB、MOBI、AZW3、PDF、TXT、FB2、DOCX、HTML 等几乎所有常见格式互转,能自动生成目录、抓取元数据、批量处理整个书库。缺点是界面偏工具化、PDF 转出效果一般,且转换选项较多需要花点时间理解。
SumatraPDF
免费阅读器轻量阅读器,支持 PDF、EPUB、MOBI、CBZ 等,可把 PDF 内容另存为文本。用于「先看看内容能不能正确抽取出来」这一步很快 —— 如果它选中的文字是乱的,转换前就需要先做 OCR。
常见问题
Markdown/DOCX 转 EPUB 会丢失什么?
两端结构相近,主要损失是排版细节的细微差异。
用什么工具把 Markdown/DOCX 转成 EPUB?
推荐 Sigil、Calibre、SumatraPDF。其中 Sigil 最适合这个组合;专做 EPUB 的可视化编辑器,能直接改内部 XHTML/CSS、修目录、补元数据。适合「EPUB 转出来后需要精修」的场景 —— 比如章节切错了、封面没进去、排版要调。它不做格式转换,只做 EPUB 的编辑。
Markdown/DOCX 转 EPUB 需要注意什么?
源文件的章节只是普通文字行,而目标格式要求一份真正的目录。转换器会尝试用正则识别「第X章」「Chapter N」这类模式 —— 识别不准就会出现目录条目错乱或整本书只有一个章节。转换后请检查目录条目数与实际章数是否一致。
转换完,用什么读?
阅竹 Tide Reader 支持 TXT 与 EPUB,导入即自动识别章节、按你的习惯排版,阅读进度在 Windows、macOS、iOS、Android 之间同步。转换出来的文件直接拖进来就能读。
免费下载阅竹支持 TXT / EPUB;本地阅读优先,可选云同步与 WebDAV。
