EPUB 转 TXT
在本地把 EPUB 电子书的纯文本提取为 TXT,按阅读顺序,无需上传。
正在你的设备上本地处理 ...
你的文件
正在你的设备上本地处理 ...
0%
你的文件从未离开你的设备
我的文件会被上传吗?
不会。一切都在你的浏览器中运行,你的文件永不离开你的设备。这一点如何验证
在本地把 EPUB 电子书的纯文本提取为 TXT,按阅读顺序,无需上传。
正在你的设备上本地处理 ...
正在你的设备上本地处理 ...
0%
你的文件从未离开你的设备
不会。一切都在你的浏览器中运行,你的文件永不离开你的设备。这一点如何验证
EPUB 本质上是一个由 XHTML 章节组成的 ZIP 压缩包,再加上一个定义阅读顺序的控制文件(OPF),也就是所谓的书脊(spine)。这种结构很适合阅读,但当你只需要纯文本时就显得不便:无论是引用、搜索、粘贴到笔记应用,还是用程序进一步处理。本工具会解包 EPUB,严格按书脊顺序读取各章节,并输出一个包含连续正文的 TXT 文件。
整个转换过程完全在你的浏览器本地运行(用 fflate 解包,纯 JavaScript 实现,无需上传,离线也能用)。工具会从每个章节中移除 XHTML 标记,把段落、标题等块级元素转换为换行,并将 HTML 实体还原为真正的字符。图片、字体和排版会被刻意舍弃,这里只关心可读的文字。
当你需要把电子书的内容当作一个简单文本文件来用时,这很有帮助,比如做全文搜索、写脚本或导入编辑器。受 DRM 保护的 EPUB 在技术上无法读取,工具会诚实地拒绝它,而不是生成无法使用的乱码文本。纯粹的格式、标题层级和内嵌媒体都会丢失,如果你想保留排版,选择其他格式更合适。
| 输入格式 | EPUB |
|---|---|
| 自动转换 | PDF, DOCX |
| 输出格式 | TXT |
| 批量处理 | 支持 |
| 处理方式 | 在浏览器中本地处理 (JavaScript) |
| 文件上传 | 无 |
限制: 工具按阅读顺序输出纯连续正文,不含图片、字体、排版或可点击链接。脚注和表格会被简化。受 DRM 保护的电子书在技术上无法读取,会被明确拒绝。章节结构仅以段落之间的空行体现。
不会。解包和提取全部在浏览器本地完成,离线也能用。
不支持。受 DRM 保护的 EPUB 是加密的,会被诚实地拒绝;没有 DRM 的则可以处理。
不会。工具输出纯文本,字体、图片和排版都会舍弃。段落以换行的形式保留。
正确。各章节会按 EPUB 中存储的阅读顺序(书脊)合并。
符合标准的 EPUB 文件(EPUB 2 和 3),且未加 DRM。
Markdown 转 HTML · 解压ZIP · 创建ZIP · RTF 转 TXT · PDF转EPUB · CBZ 转 PDF