PDF → EPUB
小说从 PDF(.pdf)转成 EPUB(.epub)是很常见的一步 —— EPUB 是通用电子书格式,能自动适配屏幕和字号,还带目录。不过 PDF 转 EPUB 会有额外的问题需要考虑:会丢失精确的分页与版面位置。下面详细说明 PDF 如何转成 EPUB 以及注意点,文末附带 PDF 转 EPUB 的转换工具,可以直接在浏览器里上传文件转换。
PDF 是什么
PDF 记录的不是「段落」,而是「在页面的哪个位置画什么」,所以它能把版面原样固定下来 —— 字体、分栏、图表位置在任何设备上都完全一致,打印出来也和屏幕上一样。代价是读者无法重排、不能调字号,长文在小屏幕上只能靠缩放阅读。它最适合需要严格保版式的场景,比如论文、合同、扫描件、印刷稿,以及需要长期归档、不希望被改动的文件。 查看 PDF 格式详情
| 扩展名 | .pdf |
|---|---|
| 典型用途 | 需要严格保版式的文档、论文、合同与扫描件;也可作为打印与归档格式。 |
EPUB 是什么
EPUB 是除 Kindle 生态外最通用的电子书格式,本质是一个 ZIP 包,里面装着 XHTML 正文、CSS 样式、图片,以及一份规定阅读顺序的清单文件。它把内容与排版分开存放,所以同一个文件在手机、平板和电脑上都能自动排出合适的版面,读者也能随时调整字号;目录、封面、书名与作者都有标准位置,书库软件能正确识别和排序。对以文字为主的小说来说,EPUB 通常是分发和长期保存最稳妥的格式。 查看 EPUB 格式详情
| 扩展名 | .epub |
|---|---|
| 典型用途 | 主流电子书分发与长文阅读,适合小说等以文字为主、需要按屏幕重排的书。 |
如何把 PDF 转成 EPUB
PDF 里的换行多半是「视觉换行」而不是段落结束:一个段落可能被切成 5 行、每行都是独立文本块。直接抽取会得到一堆硬回车,需要按行尾是否完整句子、行宽是否接近页宽来重新合并段落。扫描版 PDF 更是完全没有文字层,抽取结果为空白,必须先做 OCR。
EPUB 不是「压缩一下就行」:它必须包含 mimetype(且必须是第一个条目、不压缩)、META-INF/container.xml、内容 OPF 与 nav 目录,缺一项阅读器就会报「文件损坏」。所以转 EPUB 优先用成熟的转换器,不要手工拼 ZIP。
版式要「打散重建」:PDF的段落、分栏、图表位置是为固定页面排的,转成可重排格式后这些位置信息没有意义,转换器只能按文字流重新拼接。结果是段落可能被并错、分栏可能串行、图表会跑到文字中间。转换后务必通读前几章,重点看对话分段和图表附近。
源是「一页一张整图」,而目标会重排:每张图会作为独立图片按顺序插入,文字层若不存在就只剩图片流。这种情况下转出的文件往往体积巨大、无法搜索,阅读体验反而比原格式差。
源文件没有章节概念(漫画按页、PDF 按页),而目标期望有目录。转换器只能按页或按固定长度机械切分,得到的目录没有语义 —— 如果不需要导航可以忽略,但不要指望它能自动识别出「章」。
PDF 转 EPUB 工具
PDF → EPUB
这些设置会写进生成的 EPUB。字号用相对值,读者在阅读器里仍能自行调整。
转换完全在你的浏览器里完成,文件不会上传到任何服务器。
全平台同步阅读进度的小说阅读器
阅竹 Tide Reader 支持 TXT 与 EPUB,导入即自动识别章节、按你的习惯排版,阅读进度在 Windows、macOS、iOS、Android 之间同步。转换出来的文件直接拖进来就能读。
免费下载阅竹支持 TXT / EPUB;本地阅读优先,可选云同步与 WebDAV。
