Markdown/DOCX → TXT
小说从富文本(.md、.docx)转成纯文本(.txt)是很常见的一步 —— TXT 文件是纯文本文件,能在更多软件中打开,体积也更小。不过富文本转纯文本会有额外的问题需要考虑:会丢失全部插图、封面与图表;书名、作者、语言等元数据。下面详细说明富文本如何转成纯文本以及注意点,文末附带富文本转纯文本的转换工具,可以直接在浏览器里上传文件转换。
Markdown/DOCX 是什么
这里把 Markdown(.md)和 Word(.docx)放在一族,因为它们在转换里扮演同一个角色:带轻量结构的写作源文件。Markdown 是纯文本加标记符号,干净、便于版本管理,但表达力有限;.docx 是一个 ZIP 包,里面是 Office Open XML,排版信息丰富得多,分页、页眉页脚、批注和修订都能保留。两者都更适合当转换的起点,而不是最终的阅读格式 —— 它们的阅读体验都取决于用哪个软件打开。 查看 Markdown/DOCX 格式详情
| 扩展名 | .md.docx |
|---|---|
| 典型用途 | 写作与排版的源头文件;转换为 EPUB/TXT 前的中间格式。 |
TXT 是什么
TXT 是纯文本,文件里只有字符和换行,没有任何排版信息,因此体积最小、兼容性最好 —— 从最简陋的功能机到任何操作系统,几乎没有打不开它的软件。中文网络小说绝大多数以它流传,它也是复制、搜索、批量处理和二次转换最方便的格式。代价是它不保存图片、颜色、表格和目录,书名作者这些信息也无处安放,所以它更像「一份干净的正文」,而不是一本完整的书。 查看 TXT 格式详情
| 扩展名 | .txt |
|---|---|
| 典型用途 | 中文网络小说、日志与任何需要最大兼容性的纯文字内容。 |
如何把 Markdown/DOCX 转成 TXT
.docx 是 ZIP 包里的 Office Open XML,正文在 word/document.xml。其中样式(标题级别)决定章节能否被识别:如果作者用的是「手动加粗的大字」而不是「标题 1」样式,转出的 EPUB 就不会有目录。Markdown 侧则要注意它不支持复杂的表格与嵌套结构。
由于 TXT 只能保存字符,所以所有字体、字号、颜色、表格、脚注、超链接都会消失,章节标题降级为普通文字行。转换时还要选定编码(中文建议 UTF-8,老设备可能要求 GBK)。
Markdown/DOCX里的插图、封面、图表在内都是图片,而TXT格式不存图片,它们也会全部丢失,例如一些漫画Markdown/DOCX文件,由于内容都在图片中,转换成TXT文件会丢失大量内容。
Markdown/DOCX源文件里的书名、作者、出版社、语言、目录、封面等元数据在目标格式中无处存放,转成TXT格式也会全部丢失。
把结构化压缩包压平成一个文本文件时,章节顺序必须按清单文件(spine)而不是压缩包内的文件名字典序来拼接 —— 这是此类转换中最容易出错、且错误最隐蔽的一点:文件能打开,但章节是乱的。
Markdown/DOCX 转 TXT 工具
DOC → TXT
转换完全在你的浏览器里完成,文件不会上传到任何服务器。
全平台同步阅读进度的小说阅读器
阅竹 Tide Reader 支持 TXT 与 EPUB,导入即自动识别章节、按你的习惯排版,阅读进度在 Windows、macOS、iOS、Android 之间同步。转换出来的文件直接拖进来就能读。
免费下载阅竹支持 TXT / EPUB;本地阅读优先,可选云同步与 WebDAV。
