TXT → FB2
网文小说怎么从 TXT 转成 FB2:先讲清两种格式各自是什么,再说明会丢什么、有哪些坑、长篇的章节与编码要特别注意什么,最后给出该用的工具与自检清单。
TXT 是什么
TXT 是纯文本格式,文件里只有字符本身,没有任何字体、字号、颜色、图片或分页信息 —— 换行符是唯一的「结构」。中文网络小说绝大多数以 TXT 流传,原因就是它体积小、任何设备都能打开、易于复制与增量更新。代价是它不携带章节结构、没有封面与元数据,而且编码(UTF-8 / GBK / UTF-16)不一致时会出现乱码,这是 TXT 最常见的两个问题。
.txtFB2 是什么
FB2(FictionBook 2)是一个基于 XML 的开放电子书格式,在俄语地区极为流行。它把正文、元数据和插图全部写在一个 XML 文件里,插图通常以 Base64 内嵌,因此单个 .fb2 文件就是完整的书,方便分发。它的结构清晰、天然带章节与作者信息,缺点是体积偏大(Base64 会让图片膨胀约三分之一),且非俄语区的阅读器支持不如 EPUB 广泛。
.fb2TXT 转 FB2 需要注意什么
先从源格式抽出内容时
TXT 没有章节标记,章标题只是一行看起来像标题的文字。转换前最好先确认它已经被正确分章(正则能匹配「第X章」这类模式),否则到了 EPUB/Kindle 里整本书会变成没有目录的一大段。
写进目标格式时
FB2 要求正文是结构化的 XML,图片要转成 Base64 内嵌,元数据要写进 <description>。它对复杂 CSS 几乎没有支持,因此适合「纯文字 + 插图」的书,不适合依赖精细排版的排版书。
两端格式交互带来的坑
- 源文件里没有图片,因此转出的书不会有封面与插图。EPUB/Kindle 这类格式的书库界面会显示一个空白占位封面 —— 建议转换后手动补一张封面图,否则在书架上一眼认不出来。
- 源文件不携带任何元数据(TXT 就是典型),而目标格式期望有书名和作者。转换器通常会用文件名兜底,于是书库里会出现一堆「未命名」或带 .txt 后缀的标题 —— 转换时最好手工填上。
- 源文件的章节只是普通文字行,而目标格式要求一份真正的目录。转换器会尝试用正则识别「第X章」「Chapter N」这类模式 —— 识别不准就会出现目录条目错乱或整本书只有一个章节。转换后请检查目录条目数与实际章数是否一致。
- 涉及 TXT 就要盯住编码:中文 TXT 常见 UTF-8、GBK、GB18030、BIG5,还有带 BOM 与不带 BOM 的区别。写入时选 UTF-8(不带 BOM)兼容性最好;写入 GBK 是为了兼容老设备。编码选错的表现是整篇乱码,而不是报错。
- 换行符也要统一:Windows 用 CRLF、Unix 用 LF,Mac 老文本曾用 CR。混用会导致某些阅读器把所有文字显示成一行。转换后若发现「整本书挤成一段」,先查换行符。
会丢什么
- 两端结构相近,主要损失是排版细节的细微差异
会得到什么
- 真正的目录与章节跳转
- 可写入书名、作者、封面等元数据
转换后自检清单
- 先用前 3 章试转,确认没有丢字、串行或错位,再整本转换。
- 检查章节切分:目录条目数应与实际章数一致。
- 随机翻 5 处,搜索书中一个人名,确认文本可被完整检索。
- 补全书名、作者、语言;语言标签写错会导致排版(如中文断行)异常。
小说转换的特殊之处
小说是最常见、也最特殊的一类电子书:几百上千章、几乎没有图表、常常只有一份 TXT 源文件,中文源还经常带防盗乱码。下面几点是最容易踩、也最影响阅读体验的。
- 长篇小说动辄数百上千章,目录质量直接决定这本书能不能用。转换前先把章标题统一成一种可识别的写法(例如都写成「第X章 标题」并独占一行),否则目标格式里的目录会缺章、串章,甚至整本只剩一章。
- 中文网络小说的 TXT 常见三种「乱码」,处理方式完全不同:① 编码不符(把 UTF-8 当 GBK 读)—— 换对编码即可恢复;② 防盗乱码(作者故意替换了部分字符)—— 无法还原,只能换源;③ 全角半角混排或生僻字缺字 —— 属于字体问题。转换前先判断是哪一种,别把第三类当成第一类反复转码。
- 分卷信息(「第一卷」「第二卷」)在多数转换里会被降级成普通标题,卷与章的层级关系随之丢失。如果你在意层级,转换后到编辑器里把卷标题提升一级,别让它和章标题平级。
TXT 转 FB2 的工具
下面这些工具都能完成这个方向的转换,按你的操作系统和文件数量挑一个即可。动手前建议先看上一节的注意事项 —— 顺序错了(比如该先 OCR 却直接转)往往要重来一遍。
Calibre
免费桌面应用电子书转换的事实标准,免费开源。支持 EPUB、MOBI、AZW3、PDF、TXT、FB2、DOCX、HTML 等几乎所有常见格式互转,能自动生成目录、抓取元数据、批量处理整个书库。缺点是界面偏工具化、PDF 转出效果一般,且转换选项较多需要花点时间理解。
CloudConvert
免费在线服务在线通用转换服务,免安装、格式覆盖广,适合偶尔转一两个文件。要注意文件会上传到第三方服务器 —— 有版权或隐私顾虑的内容不要用它;免费额度也有限。
SumatraPDF
免费阅读器轻量阅读器,支持 PDF、EPUB、MOBI、CBZ 等,可把 PDF 内容另存为文本。用于「先看看内容能不能正确抽取出来」这一步很快 —— 如果它选中的文字是乱的,转换前就需要先做 OCR。
常见问题
TXT 转 FB2 会丢失什么?
两端结构相近,主要损失是排版细节的细微差异。
用什么工具把 TXT 转成 FB2?
推荐 Calibre、CloudConvert、SumatraPDF。其中 Calibre 最适合这个组合;电子书转换的事实标准,免费开源。支持 EPUB、MOBI、AZW3、PDF、TXT、FB2、DOCX、HTML 等几乎所有常见格式互转,能自动生成目录、抓取元数据、批量处理整个书库。缺点是界面偏工具化、PDF 转出效果一般,且转换选项较多需要花点时间理解。
TXT 转 FB2 需要注意什么?
源文件里没有图片,因此转出的书不会有封面与插图。EPUB/Kindle 这类格式的书库界面会显示一个空白占位封面 —— 建议转换后手动补一张封面图,否则在书架上一眼认不出来。 源文件不携带任何元数据(TXT 就是典型),而目标格式期望有书名和作者。转换器通常会用文件名兜底,于是书库里会出现一堆「未命名」或带 .txt 后缀的标题 —— 转换时最好手工填上。 源文件的章节只是普通文字行,而目标格式要求一份真正的目录。转换器会尝试用正则识别「第X章」「Chapter N」这类模式 —— 识别不准就会出现目录条目错乱或整本书只有一个章节。转换后请检查目录条目数与实际章数是否一致。 涉及 TXT 就要盯住编码:中文 TXT 常见 UTF-8、GBK、GB18030、BIG5,还有带 BOM 与不带 BOM 的区别。写入时选 UTF-8(不带 BOM)兼容性最好;写入 GBK 是为了兼容老设备。编码选错的表现是整篇乱码,而不是报错。 换行符也要统一:Windows 用 CRLF、Unix 用 LF,Mac 老文本曾用 CR。混用会导致某些阅读器把所有文字显示成一行。转换后若发现「整本书挤成一段」,先查换行符。
转换完,用什么读?
阅竹 Tide Reader 支持 TXT 与 EPUB,导入即自动识别章节、按你的习惯排版,阅读进度在 Windows、macOS、iOS、Android 之间同步。转换出来的文件直接拖进来就能读。
免费下载阅竹支持 TXT / EPUB;本地阅读优先,可选云同步与 WebDAV。
