EPUB → Markdown
小说从 EPUB(.epub)转成 Markdown(.md)是很常见的一步 —— Markdown 是纯文本,任何编辑器都能打开,也便于版本管理。不过 EPUB 转 Markdown 会有额外的问题需要考虑:会丢失书名、作者、语言等元数据。下面详细说明 EPUB 如何转成 Markdown 以及注意点,文末附带 EPUB 转 Markdown 的转换工具,可以直接在浏览器里上传文件转换。
EPUB 是什么
EPUB 是除 Kindle 生态外最通用的电子书格式,本质是一个 ZIP 包,里面装着 XHTML 正文、CSS 样式、图片,以及一份规定阅读顺序的清单文件。它把内容与排版分开存放,所以同一个文件在手机、平板和电脑上都能自动排出合适的版面,读者也能随时调整字号;目录、封面、书名与作者都有标准位置,书库软件能正确识别和排序。对以文字为主的小说来说,EPUB 通常是分发和长期保存最稳妥的格式。 查看 EPUB 格式详情
| 扩展名 | .epub |
|---|---|
| 典型用途 | 主流电子书分发与长文阅读,适合小说等以文字为主、需要按屏幕重排的书。 |
Markdown 是什么
Markdown 是纯文本加标记符号(# 标题、** 加粗、| 表格),本质上是 .txt 的超集 —— 任何文本编辑器都能打开,也天然适合版本管理。它的表达力刻意保持有限:没有分页、没有页眉页脚,也不能精确控制字号与位置,复杂排版做不了。这些取舍让 Markdown 成为很好的写作与转换起点,但作为最终阅读格式,阅读体验完全取决于用哪个软件打开它。 查看 Markdown 格式详情
| 扩展名 | .md |
|---|---|
| 典型用途 | 写作、笔记与技术文档;转换为 EPUB/TXT 的干净中间格式。 |
如何把 EPUB 转成 Markdown
EPUB 的正文是 XHTML 片段 + 独立的 CSS,抽取时必须同时解析 OPF 清单里的 spine 顺序(阅读顺序)和 toc(目录)。如果只按压缩包里的文件名字典序拼正文,章节顺序会错乱 —— 这是把 EPUB 转成单个 TXT 时最常见的错误。
输出 Markdown 只保留文字与最基本的层级(# 标题、段落、简单列表)。原格式里的分页、页眉页脚、批注、修订、精确字号与图文环绕都会消失 —— 它适合当「内容存档」,不适合当「排版存档」。
EPUB源文件里的书名、作者、出版社、语言、目录、封面等元数据在目标格式中无处存放,转成Markdown格式也会全部丢失。
若希望Markdown文件仍有目录导航能力,可考虑用小说阅读软件(例如阅竹)通过解析正文中明确的章标题行进行智能分章。
把结构化压缩包压平成一个文本文件时,章节顺序必须按清单文件(spine)而不是压缩包内的文件名字典序来拼接 —— 这是此类转换中最容易出错、且错误最隐蔽的一点:文件能打开,但章节是乱的。
EPUB 转 Markdown 工具
EPUB → MARKDOWN
转换完全在你的浏览器里完成,文件不会上传到任何服务器。
全平台同步阅读进度的小说阅读器
阅竹 Tide Reader 支持 TXT 与 EPUB,导入即自动识别章节、按你的习惯排版,阅读进度在 Windows、macOS、iOS、Android 之间同步。转换出来的文件直接拖进来就能读。
免费下载阅竹支持 TXT / EPUB;本地阅读优先,可选云同步与 WebDAV。
